AWS認定試験 AI Practitioner(予想問題) その19

問題 15 / 65

ロボットが環境での試行錯誤を通じて報酬を最大化する行動方針を学ばせたい。最もふさわしい学習枠組みはどれか?

教師あり学習
教師なし学習
強化学習
転移学習
半教師あり学習

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。