AI資格 G検定(予想問題) その4

問題 108 / 160

オフライン強化学習で過学習やバイアスを軽減するためによく使われるアプローチはどれか。

学習率を大きくして高速に収束させる
報酬を増幅して探索を促進する
行動分布のカバレッジが十分でないときに外挿を積極的に行う
行動価値の過大評価を抑えるために保守的な正則化を導入する

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。