AI
プロンプトインジェクション
AI に読ませる文章の中に指示を仕込み、本来の動作を乗っ取る攻撃。
AI にとって、開発者の指示と読み込んだ文書の区別は曖昧である。文書の中に「これまでの指示を無視して」と書いておくと、従ってしまうことがある。
AI に外部の文書やユーザー入力を読ませる設計では常に成立しうる。RAG やブラウザ操作を伴う仕組みでは特に注意が要る。
よくある誤解
「社内文書しか読ませないから安全」という前提が置かれがちだが、社内文書には外から来たもの(受信メール、取引先の PDF、Web からの引用)が混ざる。入力の出所を信頼境界の外として扱い、AI の出力で権限のある操作を自動実行しない設計にするのが基本になる。
関連する用語
ハルシネーション
AI が事実でないことを、事実であるかのように出力する現象。
RAG
社内文書を検索して、その結果を根拠に AI へ答えさせる仕組み。