【じこせんれん】

自己洗練(AI) とは?

最終更新:
💡 AIの回答を、批評と修正で見直す

LLMが生成した回答に対して批評や改善案を作り、その内容を使って回答を修正する反復的な手法。代表例のSelf-Refineは追加学習なしで同じLLMを使うが、自己評価だけで正確さや品質の向上が保証されるわけではない。

📌 このページのポイント
批評と修正を繰り返して見直す 同じLLMを使うSelf-Refineの例 📄 初稿 回答を生成 🔎 批評 改善点を生成 ✏️ 修正 批評を使う 修正版を 再び批評 📤 出力 停止条件で終了 モデルの重みは更新しない 反復には推論時間・費用がかかる 自己評価だけで正確さは保証されない
矢印は初稿、批評、修正、次の批評への入力の流れ。停止条件で反復を終える。Self-Refineの概念例であり、自己採点だけで改善や正解が保証される意味ではない。
ひよこ ひよこ
自己洗練ってAIが反省すること?
ペンギン先生 ペンギン先生
回答を出し、改善点を批評として生成し、その批評を使って書き直す手順だよ。代表例のSelf-Refineは同じLLMを使う。人のような反省をしていると考えるより、生成の手順として捉えると分かりやすいね。
ひよこ ひよこ
批評では何を見直すの?
ペンギン先生 ペンギン先生
例えば文章が長すぎる、指定された条件を満たしていない、という点を具体的に挙げるよ。批評自体も生成文なので、事実や論理の指摘が正しいかは別に確認する必要があるんだ。
ひよこ ひよこ
ずっと繰り返すの?
ペンギン先生 ペンギン先生
最大回数や課題ごとの停止条件を決めるよ。修正版を次の批評に渡して反復するけれど、自己採点が高いだけで正解とは限らない。元の回答から悪くなっていないかも比較するんだ。
ひよこ ひよこ
RLHFとはどう違うの?
ペンギン先生 ペンギン先生
RLHFはフィードバックを使った強化学習に関わる手法だよ。Self-Refineの反復ではモデルの重みを更新せず、指示や前の回答を入力して修正する。追加学習が不要でも、反復する分の推論時間や費用はかかるんだ。
ひよこ ひよこ
数学の問題も見直せば必ず正しくなる?
ペンギン先生 ペンギン先生
保証はないよ。Self-Refineでは文章編集などで改善が報告された一方、別の研究では外部のフィードバックなしの推論問題で改善しない例や悪化も報告されている。課題に応じてテストや根拠との照合を組み合わせよう。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「自己洗練」って出てきたら「AIが自分の答えを見直して書き直す仕組み」と思えればだいたいOK!
📖 おまけ:英語の意味
「Self-Refinement」 = 自己洗練・自己改善
💬 Selfは「自分自身」、refinementは「改良・洗練」を表すよ。2023年のSelf-Refineという研究では、同じLLMがフィードバックと修正を繰り返す方法を示したんだ。

参考資料

← 用語集にもどる