【ぷれぱれどねすふれーむわーく】

Preparedness Framework(準備フレームワーク) とは?

公開:
💡 危険すぎるAIには「出荷停止」のラベルを貼る仕組み
📌 このページのポイント
Preparedness Framework — 領域別・段階別の危険度評価 評価領域 Low Medium High Critical サイバー攻撃 Astra! CBRN(化学・生物等) 説得・世論操作 問題なし 要注意 高リスク Critical(リリース禁止) Astra はサイバー分野で初のCritical到達可能性を示した
Preparedness Framework:領域ごとに危険度を4段階評価し、Critical認定モデルはリリース禁止
ひよこ ひよこ
Preparedness Frameworkって、どんな仕組みなの?
ペンギン先生 ペンギン先生
OpenAIが2023年に公開したAI安全評価の体系だよ。サイバー攻撃・生物兵器・核・説得力など複数の分野ごとに、AIの能力をLow・Medium・High・Criticalの4段階で評価するんだ。
ひよこ ひよこ
どうやって段階を決めるの?
ペンギン先生 ペンギン先生
例えばサイバー分野だと、「人間なしで未発見の脆弱性を自律的に見つけて攻撃できるか」という基準で判定するよ。実際にセキュリティの専門家チームがAIとテストを行って評価するんだ。
ひよこ ひよこ
Criticalになったらどうなるの?
ペンギン先生 ペンギン先生
そのモデルはリリースしてはいけない、というルールがあるんだ。2026年8月にAstraというモデルがCritical水準に達する可能性があると判定されて、開発が制限されたのはその初めての実例だよ。
ひよこ ひよこ
OpenAI以外もこういう仕組みを持ってるの?
ペンギン先生 ペンギン先生
Anthropicの「RSP(Responsible Scaling Policy)」やGoogle DeepMindの「Frontier Safety Framework」が似た仕組みだよ。呼び名は違うけど「AIの危険度をモニタリングして、一定水準を超えたら制限する」という考え方は共通しているんだ。業界全体で広がりつつある重要な概念だよ。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「Preparedness Framework」って出てきたら「OpenAIのAI危険度通知表」と思えればだいたいOK!
📖 おまけ:英語の意味
「Preparedness Framework」 = 準備態勢フレームワーク
💬 「Preparedness」は「(災害や脅威への)備え・準備態勢」という意味で、「AIが危険な能力を持ち始めたときに備える枠組み」という趣旨だよ。
← 用語集にもどる