AWS認定試験 AI Practitioner(予想問題) その1
通常
試験時間: 00:00問題時間: 00:00
問題一覧
問題 32 / 65
大量の同時接続がある多言語翻訳サービスで推論コストを削減しつつ精度を維持する最適な戦略はどれか?
①モデルを極端に量子化して精度を問わず軽量化する
②すべてのリクエストを同じ大型モデルで逐次処理する
③キャッシュやバッチ処理を全く行わない
④ユーザーごとに毎回フルサイズモデルで個別推論する
⑤モデル蒸留で軽量モデルを作り必要に応じて大きなモデルへルーティングするハイブリッド運用にする
