【ちぇいんおぶそーと】
Chain-of-Thought(思考の連鎖) とは?
最終更新:
💡 結論の前に、中間の推論をつなぐ
結論へ至る中間の推論ステップを生成し、つなげていく考え方。プロンプトに解法の例を示したり、段階的な説明を促したりする方法が研究されている。効果はモデルや課題によって異なる。
📌 このページのポイント
- 結論だけでなく、途中の計算や推論のステップを生成する
- 推論付きの例を示すfew-shotと、例なしで段階的な推論を促すzero-shotの方法がある
- 算数や論理などで改善が報告されているが、いつでも正解になるわけではない
- 生成された説明は検証に役立つ場合があるが、内部処理の忠実な記録とは限らない
Chain-of-Thoughtってどういうこと?
結論の前に、中間の推論ステップを生成することだよ。たとえば「りんごが1箱に3個、5箱ある」なら、「1箱3個、箱は5つ、3×5=15個」とつなげる。途中を分けると説明を確認しやすくなるけれど、途中式を書けば必ず正しくなる、という意味ではないんだ。
どうやって推論を促すの?
2022年の論文では、問題・途中の推論・答えを組にした例をプロンプトに示す方法が研究されたよ。例を示すfew-shotに対して、例なしで「段階的に考えよう」と促すzero-shotの方法も研究されている。どちらも、結論だけを直接生成する方法との違いに注目しているんだ。
どんなモデルや問題でも効果があるの?
モデルや課題、指示の方法によるよ。元の研究では、算数の文章題や常識推論などで改善が報告されたけれど、特定の実験の結果をすべてのモデルや問題に当てはめることはできない。自分の用途では、答えの正しさや処理時間などを実際に比較しよう。
説明が見えれば、AIの内部も全部わかる?
出力された説明が、内部の処理を忠実に表しているとは限らないよ。研究では、回答に影響した手掛かりを説明に出さず、もっともらしい理由を生成する例も報告されている。計算や根拠を確認する助けにはなるけれど、説明と最終回答の両方を検証することが大切なんだ。
今の推論モデルにも「ステップごとに」と書くべき?
まとめ:ざっくりこれだけ覚えればOK!
「Chain-of-Thought」って出てきたら「結論へ至る中間の推論ステップをつなぐ考え方」と思えばだいたいOK!
📖 おまけ:英語の意味
「Chain of Thought」 = 思考の連鎖
💬 思考を鎖のようにつなげて段階的に進める、という意味。2022年にGoogleの研究者が発表した論文で広まったよ