Policy Gradientと教師あり学習の類似性(Similarities between policy gradient methods (PGM) in reinforcement learning (RL) and supervised learning (SL))
田中専務拓海先生、お忙しいところすみません。最近、部署で『強化学習』とか『Policy Gradient』の話が出てきて、正直よくわからないのですが、経営判断として見ておくべきポイントを教えていただけますか。AIメンター拓海素晴らしい着眼点ですね!大丈夫、短く整理しますよ。要点は3つです