↑: [[G検定に関する知識]] - OpenAIが開発したテキスト・トゥ・イメージ生成モデル - CLIPの埋め込み表現+拡散モデルを組み合わせた構造 - 抽象的な指示も理解して高品質な画像を生成できる - cf. [[CLIP]], [[拡散モデル]], [[テキスト・トゥ・イメージ]]