【えーあいあんぜんせい】
AI安全性(AIセーフティ) とは?
最終更新:
💡 AIの便利さと一緒に、起こりうる害も確かめる
AIが人や社会へもたらす害を見つけ、減らすための研究や運用上の取り組み。モデルだけでなく使い方や周囲の仕組みも評価し、導入後も対策を見直します。
📌 このページのポイント
- 利用する場面で、どんな害が起こりうるか考える
- 設計・評価・権限・監視などの対策を組み合わせる
- 一つの対策だけで、安全が保証されるわけではない
- 導入後も問題や変更を追い、必要に応じて修正・停止する
AIが暴走する映画みたいな話?
将来の高度なAIも研究対象だけど、今の使い方でも考えることがあるよ。例えば誤った回答をそのまま重要な判断に使う、機密情報を出力する、といった場面。誰にどんな影響があるかを具体的に調べるんだ。
危険な回答を止める仕組みを付ければいい?
ガードレールなどは役立つけど、それだけでは十分とは限らない。想定する入力で評価し、悪意ある入力も試す。外部の指示にだまされるリスクには、資料の扱い方やツールの権限を制限する対策も組み合わせるよ。
公平さやプライバシーとも関係する?
公開前に試せば、もう終わり?
使われ方やモデルが変わると、リスクも変わるよ。導入後も不具合や利用者の報告を確認し、修正や停止の方法と責任を決めておこう。すべてを防げると宣言するより、何を確かめ、どんな対策を取り、何が残るかを説明できることが大切なんだ。
📖 おまけ:英語の意味
「AI Safety」 = AIの安全性
💬 人の生命・健康・財産や環境などを危険にさらさない使い方を考える分野です。安全を評価するには、AI単体の能力だけでなく利用条件や影響も見る必要があります。