インフラ用語集へ戻る

AI・LLM / AIセキュリティ

プロンプトインジェクションとは

Prompt injection。入力や参照文書に紛れた指示で、AIの本来の制約を迂回させようとする攻撃です。

用語集内のカードを見る

詳細な図解

外部入力がAIの制約を上書きしようとする流れ
外部文書/入力隠れた指示が混入
RAG/Agent根拠やツール入力へ入る
モデル判断本来の指示と衝突する
防御/監査分離、拒否、承認で止める
  • 文書内容を命令として扱わせない
  • ツール権限を最小化する
  • 攻撃入力で評価する

この記事で学べること

プロンプトインジェクションを、定義だけで終わらせず、現場で出てくる場面、確認材料、見落としやすい点、関連語とのつながりまで順に確認できます。

  1. プロンプトインジェクションの責任範囲
  2. プロンプトインジェクションの障害時の見方
  3. プロンプトインジェクションの確認粒度
  4. プロンプトインジェクションの似た用語との差分
  5. プロンプトインジェクションの次の調査への渡し方

プロンプトインジェクションの責任範囲

プロンプトインジェクション(Prompt injection)は、入力や参照文書に紛れた指示で、AIの本来の制約を迂回させようとする攻撃です。

AIセキュリティの作業では、プロンプトインジェクションを「ブラウザ、TLS終端、HTTPヘッダー、アクセス制御を分けて確認する」ための言葉として扱います。値や名称を覚えていても、どの画面、どのログ、どの経路で効いているかを言えなければ、変更後の説明や障害報告には使いにくくなります。

システムプロンプト、RAG、Agentと並べると、プロンプトインジェクションが前提なのか、結果なのか、確認手段なのかを分けやすくなります。

プロンプトインジェクションの障害時の見方

RAG、チャットボット、Agent、外部サイト要約、メール処理AIで注意します。

作業前には、対象、確認元、利用者影響、戻し条件を短く書き出します。ここを曖昧にしたまま値を直すと、作業後に成功した通信だけが残り、なぜその状態で完了と判断したかを説明できません。

  • プロンプトインジェクションを使う対象と所有者を確認する。
  • 正常時、変更前、変更後の差分を同じ観点で比較する。
  • システムプロンプト、RAG、Agentとの関係を作業メモに残す。

プロンプトインジェクションの確認粒度

外部入力の分離、ツール権限、秘密情報保護、拒否テスト、ログを確認します。

証跡には、レスポンスヘッダー、証明書チェーン、ブラウザConsole、WAFやCDNログを同じ時刻帯でそろえます。画面の表示だけ、単発の疎通結果だけ、誰かの口頭説明だけでは、後から別の担当者が再確認できません。

  • 確認した場所、コマンド、画面名、時刻を残す。
  • 成功結果だけでなく、失敗時のログやエラーも保存する。
  • 値の根拠をチケット、台帳、設計資料へ紐付ける。

プロンプトインジェクションの似た用語との差分

curlで成功しても、ブラウザ制約、Cookie属性、CSP、CORS、キャッシュで失敗することがある。プロンプトインジェクションでも、表示上の有効化、単発の成功、設定値の一致だけで完了にすると、例外条件や古い経路が残る場合があります。

似た用語との差は、説明文の言い換えではなく作業結果で確認します。システムプロンプト、RAG、Agentのどれが入力で、どれが制御で、どれが確認結果なのかを分けると、レビューで話が戻りにくくなります。

  • 単一の画面、単一のログ、単一の成功結果だけで完了にしない。
  • 一時例外には理由、期限、削除条件を付ける。
  • 影響が残る利用者、経路、権限、データを明記する。

プロンプトインジェクションの次の調査への渡し方

引き継ぎでは、プロンプトインジェクションの説明だけでなく、次に見る資料、異常時の連絡先、戻し判断の条件を残します。作業の最後に、設定値、利用者影響、証跡、関連語がつながっているかを確認します。

プロンプトインジェクションを単独の知識で閉じず、システムプロンプト、RAG、Agentと並べて説明できれば、設計、障害対応、監査のどの場面でも使いやすくなります。

  • 作業後の確認結果と残課題を同じ記録に残す。
  • 次回見直しの条件と担当を決める。
  • 関連語としてシステムプロンプト、RAG、Agentを添え、次の調査順を示す。

関連語

同じ主要カテゴリの用語

AI・LLMの学習順

同じ主要カテゴリの用語をまとめて確認できます。現在の用語を起点に、前後の用語へ進むと文脈を保ったまま読み進められます。

InfraEngKit内の関連機能