↑: [[G検定に関する知識]] - テキスト(文章)を入力として画像を生成するタスク - マルチモーダルAIの3大タスクの1つ - 代表モデル:DALL-E(OpenAI)、Stable Diffusion - 抽象的な指示も理解して画像を生成できる - cf. [[DALL-E]], [[Stable Diffusion]], [[マルチモーダル]]