【えるえるえむせきゅりてぃ】

LLMセキュリティ とは?

最終更新:
💡 AIへの入力から、データの権限と実行先まで守る

大規模言語モデル(LLM)を使うシステムの、モデル・データ・アプリ・連携ツールを守る対策。従来のアクセス制御などに加え、プロンプトインジェクションや過剰な操作権限などのリスクも扱う。

📌 このページのポイント
モデルだけでなく、使う仕組みも守る入力・文書不正な指示も混ざり得るLLM応答や操作を生成・提案使う側で検査出力・実行先重要操作の承認アプリ・データ・ツールで権限を制限参照できる資料と、実行できる操作を絞る入力フィルターだけで完全には防げない
矢印は入力からモデルの出力を使うまでの流れです。外部文書は信頼できる指示とは限らず、認可はLLM任せにせず、アプリや連携先で強制します。
ひよこ ひよこ
LLMセキュリティって、普通のセキュリティとは違うの?
ペンギン先生 ペンギン先生
LLMは自然言語で指示とデータを扱うので、入力の中の不正な指示に影響されるリスクもあるよ。それに加えて、情報漏えいやアクセス制御、連携APIの権限など、従来からある問題も残る。モデルだけでなく、それを使うシステム全体を守る必要があるんだ
ひよこ ひよこ
言葉で騙すって、どんな感じなのかな?
ペンギン先生 ペンギン先生
プロンプトインジェクションでは、不正な指示が入力に入り、本来の動作を変えようとするよ。利用者が直接入力する場合も、検索したWebページやRAGの文書に紛れ込む場合もある。外部の文章を読むだけでも、その文章を信頼できる指示として扱わない設計が必要なんだ
ひよこ ひよこ
OWASPがまとめてるリストがあるんだよね?
ペンギン先生 ペンギン先生
OWASPのLLMアプリ向けTop 10(2025年版)があるよ。プロンプトインジェクション、機密情報の開示、サプライチェーン、データやモデルの汚染、不適切な出力の扱い、過剰な操作能力などを整理している。10項目に対応しただけで、全てのリスクがなくなるわけではないんだ
ひよこ ひよこ
どうやって守ればいいの?
ペンギン先生 ペンギン先生
入出力の検査に加え、ツールの機能と権限を必要最小限にし、重要な操作には承認を入れるよ。出力をそのまま命令やSQLなどとして実行せず、使う側でも検証する。認可はLLMの判断任せにせずアプリや実行先で強制するんだ。入力フィルターだけで完全に防げるわけではないよ
ひよこ ひよこ
社内の資料をRAGで参照させるときは?
ペンギン先生 ペンギン先生
検索する段階で、その利用者が参照できる資料に絞ろう。情報の区分や利用者ごとのアクセス制御、検索・回答の記録なども設計する。「機密を答えないで」とLLMに頼むだけでは、参照権限の代わりにならないんだ
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「LLMセキュリティ」って出てきたら「LLMを使うシステムのデータや操作を守る対策」と思えばだいたいOK!
📖 おまけ:英語の意味
「LLM Security」 = 大規模言語モデルの安全対策
💬 LLMはLarge Language Modelの略だよ。自然言語の指示を扱う部分に加えて、従来のアプリと同じようにデータやAPIの権限も守るんだ

参考資料

← 用語集にもどる