AWS認定試験 AI Practitioner(予想問題) その1
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 18 / 65
リアルタイムのテキスト生成サービスで高頻度のリクエストに対する推論遅延を低く保つために最も有効な対策はどれか
①夜間にまとめてバッチ処理してレスポンスを返す
②大量のログを出力して後から解析する
③プロビジョンドコンカレンシーや専用推論インスタンスなどの事前確保でホットな推論容量を用意する
④応答を生成するために多段階のモデルチェーンを追加する
⑤結果をS3に保存してクライアントが後で取りに来る方式にする
