AWS認定試験 AI Practitioner(予想問題) その1

問題 32 / 65

大量の同時接続がある多言語翻訳サービスで推論コストを削減しつつ精度を維持する最適な戦略はどれか?

モデルを極端に量子化して精度を問わず軽量化する
すべてのリクエストを同じ大型モデルで逐次処理する
キャッシュやバッチ処理を全く行わない
ユーザーごとに毎回フルサイズモデルで個別推論する
モデル蒸留で軽量モデルを作り必要に応じて大きなモデルへルーティングするハイブリッド運用にする

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。