AI資格 G検定(予想問題) その7
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 42 / 160
強化学習において価値関数の更新式で将来の報酬を現在の価値に割り引くために用いる定数は何か
①割引率
②学習率
③探索率
④報酬正規化係数
強化学習において価値関数の更新式で将来の報酬を現在の価値に割り引くために用いる定数は何か
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。