AI資格 G検定(予想問題) その5
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 28 / 160
強化学習で状態価値関数V(s)と行動価値関数Q(s,a)を結ぶ基本的な再帰関係はどれか。
①Bellman期待方程式
②クロスエントロピー損失
③パーセプトロン更新則
④ユニバーサル近似定理
強化学習で状態価値関数V(s)と行動価値関数Q(s,a)を結ぶ基本的な再帰関係はどれか。
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。