AWS認定試験 AI Practitioner(予想問題) その1

問題 18 / 65

リアルタイムのテキスト生成サービスで高頻度のリクエストに対する推論遅延を低く保つために最も有効な対策はどれか

夜間にまとめてバッチ処理してレスポンスを返す
大量のログを出力して後から解析する
プロビジョンドコンカレンシーや専用推論インスタンスなどの事前確保でホットな推論容量を用意する
応答を生成するために多段階のモデルチェーンを追加する
結果をS3に保存してクライアントが後で取りに来る方式にする

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。