AWS Certification Exam AI Practitioner (Practice Questions) set13

問題 20 / 65

Which technique is most effective when prioritizing response latency and on-device execution?

Model compression techniques such as quantization and pruning.
Scaling out server-side inference using a large number of GPUs.
Increase training data through data augmentation.
Replace with a multimodal model.
Stop tokenizing and process raw strings.

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。