【さいきてきじこかいぜん】

再帰的自己改善(RSI) とは?

最終更新:
💡 改善したAIが、次の改善にも参加するサイクル

AIによる改善を次のAIシステムに引き継ぎ、その改善版がさらに改善を担う循環。限定した自己改良の研究から、後継モデル開発全体の自律化まで、使われる範囲は文脈で異なる。

📌 このページのポイント
改善版が、次の改善にも参加今のAI改善を提案試す・評価効果を確認改良したAI変更を引き継ぐ改良版が、次のサイクルを担う改善は、評価して確かめよう
自己改良の循環のイメージ。毎回の性能向上や、後継モデル開発全体の完全自律化が保証された図ではありません。
ひよこ ひよこ
AIが自分を改善するって、どういうこと?
ペンギン先生 ペンギン先生
たとえばAIエージェントが、自分の処理コードの変更を提案し、実験で効果を確かめ、よい変更を取り込む。その改良版が次の改善も担う、という循環だよ。AIが後継のモデルの設計や学習に参加する、もっと広い意味でも使われる言葉なんだ。
ひよこ ひよこ
「もっとよい答えを書いて」と頼むのも同じ?
ペンギン先生 ペンギン先生
回答をその場で書き直すだけでは、次の改善を担うシステムまで変わったとは限らないよ。何を改善し、その変更がどこに保存され、次のサイクルに使われるのかを区別しよう。AIが改善案を出しても、実装や評価を人が担当する場合もあるんだ。
ひよこ ひよこ
もう、次のAIを全部自動で作れるの?
ペンギン先生 ペンギン先生
研究対象と範囲を見よう。2026年9月の研究には、AI研究エージェントが自分のコードを改良し、指定された研究タスクで効率を高める実験がある。一方、Anthropicは、後継モデルの開発全体を自律的に担う意味での再帰的自己改善には、まだ到達していないと説明しているよ。限定した成功と完全自律は分けて考えよう。
ひよこ ひよこ
改良を繰り返せば、必ずどんどん賢くなる?
ペンギン先生 ペンギン先生
改善案が失敗したり、ある試験だけに合わせすぎたりすることもあるよ。計算資源や、まだ改善できていない工程も制約になる。効果を別の評価で確かめ、悪い変更を採用しない仕組みが大切。無限に伸び続けると決まった話ではないんだ。
ひよこ ひよこ
人が確認するのは、何のため?
ペンギン先生 ペンギン先生
能力が変わるときに、期待する動作や安全性も確かめるためだよ。改善が速まれば、人が理解したり制御したりすることが難しくなる可能性が議論されている。どこまで任せるか、何を評価するか、問題があれば戻せるかを決める必要があるんだ。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「再帰的自己改善」って出てきたら「改善したAIが、さらに次の改善にも参加するサイクル」と思えばだいたいOK!
📖 おまけ:英語の意味
「Recursive Self-Improvement」 = 再帰的自己改善
💬 改善の結果が、次の改善を行う仕組みに戻ってくることを表すよ。プログラムの再帰関数と同じ実装が必要、という意味ではないんだ

参考資料

← 用語集にもどる