AI資格 G検定(予想問題) その4
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 100 / 160
方策勾配法(Policy Gradient)の主な利点はどれか。
①値関数のみを学習するので実装が簡単である
②連続行動空間には適さない
③必ずモデルベースである
④方策を直接パラメータ化して確率的方策をサンプルから最適化できる
方策勾配法(Policy Gradient)の主な利点はどれか。
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。