AI資格 G検定(予想問題) その5

問題 28 / 160

強化学習で状態価値関数V(s)と行動価値関数Q(s,a)を結ぶ基本的な再帰関係はどれか。

Bellman期待方程式
クロスエントロピー損失
パーセプトロン更新則
ユニバーサル近似定理

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。