試験
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 26 / 65
Which learning method is most appropriate when you want to optimize rewards while making continuous sequential decisions over time, as in airline dynamic pricing?
①Supervised learning (Supervised Learning)
②Unsupervised learning (Unsupervised Learning)
③Clustering
④Reinforcement learning
⑤Dimensionality Reduction
