AI資格 G検定(予想問題) その2

問題 50 / 160

画像パッチや特徴をテキストトークンとともにトランスフォーマーで直接処理することで効率的な視覚言語理解を行うモデルはどれですか。

ResNet
BERT
CLIP
ViLT

当サイトでは、ユーザー体験の向上を目的としてCookieを使用しています。サイトの利用を継続することで、Cookieの使用に同意したものとみなされます。