Microsoft認定資格 AI Fundamentals(予想問題) その18
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 35 / 45
エージェントが環境からの報酬を受け取りながら試行錯誤で行動方針を学ぶ手法はどれか?
①クラスタリング(Clustering)
②強化学習(Reinforcement Learning)
③次元削減(Dimensionality Reduction)
④生成モデル(Generative Model)
エージェントが環境からの報酬を受け取りながら試行錯誤で行動方針を学ぶ手法はどれか?
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。