AI資格 G検定(予想問題) その6

問題 137 / 160

Agent57が探索性能を向上させるために導入した手法として最も適切なのはどれか

事前に人間プレイのデモを大量に与えること
ゲームごとに手動で報酬関数を作ること
内発的報酬と複数の探索ポリシーを併用すること
軽量な線形モデルのみを用いること

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。