AI資格 G検定(予想問題) その2
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 18 / 160
連続値アクション空間を対象とする強化学習で代表的に利用される手法はどれか
①タブラ型のQ学習(離散アクション向け)
②DDPGやSACのようなアクタークリティック系アルゴリズム
③離散行動専用のSARSA
④古典的なモンテカルロ木探索
連続値アクション空間を対象とする強化学習で代表的に利用される手法はどれか
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。