AI資格 G検定(予想問題) その4
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 74 / 160
RLHFにおける報酬モデルの主な役割はどれか。
①人間のフィードバックを数値化してモデル更新のための報酬信号を生成する
②学習データを自動で増加させるデータ拡張手法
③モデルの推論速度を最適化するためのハードウェア制御
④事前学習で用いる大規模コーパスの収集
RLHFにおける報酬モデルの主な役割はどれか。
当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。