↑: [[G検定に関する知識]]
- 大規模言語モデル(LLM)に対する攻撃。本来の指示(システムプロンプト)を乗っ取る
- 悪意ある入力(外部コンテンツ・ユーザー入力)が本来の指示より優先されるよう仕組む
- 人を通しても入ってくる:悪意あるウェブページ・文書・メールを読ませることで間接的に攻撃(インダイレクト・プロンプトインジェクション)
- 対策:脅威モデルの分析、サプライチェーン管理、インシデント対応手順、従業員教育
- cf. [[AIの安全性とセキュリティ]], [[アドバーサリアル・アタック]]