線形関数近似を用いたオンライン予測アルゴリズムとクロスエントロピー法(An Online Prediction Algorithm for Reinforcement Learning with Linear Function Approximation using Cross Entropy Method)
田中専務拓海先生、最近部下から「オンラインで安定した予測アルゴリズムを使えば現場のシミュレーション精度が上がる」と言われまして、ちょっと不安です。論文のタイトルは長くてよく分からないのですが、要するに何が新しいのでしょうか?AIメンター拓海素晴らしい着眼点ですね!大丈夫、簡単にまとめます