AI資格 G検定(予想問題) その7

問題 42 / 160

強化学習において価値関数の更新式で将来の報酬を現在の価値に割り引くために用いる定数は何か

割引率
学習率
探索率
報酬正規化係数

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。