Microsoft認定資格 AI Fundamentals(予想問題) その18

問題 35 / 45

エージェントが環境からの報酬を受け取りながら試行錯誤で行動方針を学ぶ手法はどれか?

クラスタリング(Clustering)
強化学習(Reinforcement Learning)
次元削減(Dimensionality Reduction)
生成モデル(Generative Model)

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。