試験

問題 15 / 65

I want a robot to learn a policy that maximizes reward through trial-and-error interactions with the environment. Which learning framework is most appropriate?

Supervised learning
Unsupervised learning
Reinforcement learning
Transfer learning
Semi-supervised learning

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。