AI資格 G検定(予想問題) その4
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 108 / 160
オフライン強化学習で過学習やバイアスを軽減するためによく使われるアプローチはどれか。
①学習率を大きくして高速に収束させる
②報酬を増幅して探索を促進する
③行動分布のカバレッジが十分でないときに外挿を積極的に行う
④行動価値の過大評価を抑えるために保守的な正則化を導入する
オフライン強化学習で過学習やバイアスを軽減するためによく使われるアプローチはどれか。
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。