【エージェントジャッキング】
Agentjacking とは?
最終更新:
💡 外部のエラーデータに潜む指示で、AIの行動を乗っ取る
AIコーディングエージェントが偽の外部データを本物の指示と誤認し、悪意あるコードを実行してしまう攻撃手法。
📌 このページのポイント
Agentjackingって何?
Tenet Securityが報告した、外部データに埋めた指示でAIコーディングエージェントを誘導し、攻撃者のコードを実行させる攻撃の呼び名だよ。間接的なプロンプトインジェクションの例として理解できるね
どうやって指示が届くの?
どのくらい確認されたの?
研究者は、検証で85%の成功率、注入可能なDSNが見つかった2,388組織、100以上のエージェントの実行を報告しているよ。2,388組織全てで実行や被害が確認されたわけではないし、この成功率を全環境に当てはめることもできないんだ
DSNを隠せば防げる?
Sentryのブラウザー用DSNは公開を前提とし、イベントの送信に使う。保存済みデータを読むための認証トークンとは違うよ。隠すことだけを対策にせず、外部データを実行指示として扱わない設計や、操作前の確認を考えるんだ
権限も見直す必要がある?
AIが実行できる操作や、読める認証情報を必要な範囲に絞ることが、悪用時の影響を減らすよ。外部データ由来のコード実行は内容を確認する。指示文を追加するだけで完全に防げるとは限らないので、実際の実行権限や確認の仕組みと組み合わせるんだ
まとめ:ざっくりこれだけ覚えればOK!
「Agentjacking」って出てきたら「AIが偽の指示に騙されてコードを実行してしまう攻撃」と思えればだいたいOK!
📖 おまけ:英語の意味
「Agentjacking」 = エージェントの乗っ取り
💬 Tenet Securityが調査で使っている攻撃の呼び名だよ。AIエージェントが扱う外部データから、行動を誘導する例として説明されているんだ