↑: [[G検定に関する知識]] - 1つのモデルで複数タスクをこなすマルチモーダルモデル - 対応タスク:画像分類・物体検出・セグメンテーション・画像説明・VQA - 入出力を統一した形式(トークン列)で表現することで実現 - cf. [[マルチモーダル]], [[マルチタスク学習]], [[基盤モデル]]