【えーあいあんぜんせい】

AI安全性(AIセーフティ) とは?

最終更新:
💡 AIの便利さと一緒に、起こりうる害も確かめる

AIが人や社会へもたらす害を見つけ、減らすための研究や運用上の取り組み。モデルだけでなく使い方や周囲の仕組みも評価し、導入後も対策を見直します。

📌 このページのポイント
AI安全性:つくる時も、使う時も害を想定利用条件影響試して評価危険な出力を確認運用で対処監視報告・修正利用やモデルが変わったら、再び評価一度の検査だけで、安全は決まらない
リスクを想定し、評価し、運用で見直す一例。赤信号の検出だけでなく、人の対応も含みます。
ひよこ ひよこ
AIが暴走する映画みたいな話?
ペンギン先生 ペンギン先生
将来の高度なAIも研究対象だけど、今の使い方でも考えることがあるよ。例えば誤った回答をそのまま重要な判断に使う、機密情報を出力する、といった場面。誰にどんな影響があるかを具体的に調べるんだ。
ひよこ ひよこ
危険な回答を止める仕組みを付ければいい?
ペンギン先生 ペンギン先生
ガードレールなどは役立つけど、それだけでは十分とは限らない。想定する入力で評価し、悪意ある入力も試す。外部の指示にだまされるリスクには、資料の扱い方やツールの権限を制限する対策も組み合わせるよ。
ひよこ ひよこ
公平さやプライバシーとも関係する?
ペンギン先生 ペンギン先生
うん。ただし同じ性質ではないんだ。NISTは安全性のほか、妥当性・信頼性、セキュリティ、説明可能性、プライバシー、公平さなどを挙げている。どれか一つがよくても、全体が信頼できるとは限らない。使う場面に応じて評価しよう。
ひよこ ひよこ
公開前に試せば、もう終わり?
ペンギン先生 ペンギン先生
使われ方やモデルが変わると、リスクも変わるよ。導入後も不具合や利用者の報告を確認し、修正や停止の方法と責任を決めておこう。すべてを防げると宣言するより、何を確かめ、どんな対策を取り、何が残るかを説明できることが大切なんだ。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「AI安全性」って出てきたら「AIがもたらす害を見つけて減らす取り組み」と思えばだいたいOK!
📖 おまけ:英語の意味
「AI Safety」 = AIの安全性
💬 人の生命・健康・財産や環境などを危険にさらさない使い方を考える分野です。安全を評価するには、AI単体の能力だけでなく利用条件や影響も見る必要があります。

参考資料

← 用語集にもどる