【とーくんばじぇっと】

トークンバジェット とは?

最終更新:
💡 AIに使わせるトークン量を、目的ごとに配分する

AIに処理させるトークン量を、目的に応じて配分・管理するための予算。出力上限、推論の目安、タスク全体の利用枠など、指す範囲は仕組みによって異なる。コンテキスト容量や料金の上限と同一ではない。

📌 このページのポイント
トークン予算:何を数える枠かを分けるコンテキストの容量履歴・ツール結果・新しい出力など出力の上限例:max_tokens全部使うとは限らない推論の予算例:budget_tokens対応モデルでは目安上限・目安・実際の使用量を区別予算を増やすだけで、正解は保証されないよ
Claude APIの設定を使った区別の例。推論予算の指定方法や、容量への算入方法はモデル・APIで確認します。
ひよこ ひよこ
トークンバジェットって、何の予算?
ペンギン先生 ペンギン先生
AIに使わせるトークン量を管理する考え方だよ。回答の出力上限、内部推論に使う目安、何回も呼び出すタスク全体の枠など、仕組みによって範囲が違う。「何を数える予算か」を最初に確認しよう。
ひよこ ひよこ
ペンギン先生 ペンギン先生
区別するよ。コンテキストは、モデルが回答するときに参照できる情報の範囲。会話履歴やツールの結果、新しい出力などが容量を使う。予算を設定しても、その容量自体が増えるわけではないんだ。
ひよこ ひよこ
予算を増やせば、必ず賢くなる?
ペンギン先生 ペンギン先生
品質の保証ではないよ。推論に使う量を増やして、難しい問題の分析が改善する場合はある。でも公式資料も、課題に応じて効果が変わり、時間との兼ね合いを評価するよう説明している。回答の正しさ、所要時間、実際の利用量を比べて調整しよう。
ひよこ ひよこ
APIでは、どんな設定がある?
ペンギン先生 ペンギン先生
Claude Messages APIのmax_tokensは生成するトークン数の上限だよ。一方、手動の拡張思考に対応するモデルのbudget_tokensは推論量の目安で、厳密な上限とは説明されていない。対応しないモデルもあり、設定の名前や範囲を資料で確認する必要があるんだ。
ひよこ ひよこ
上限を決めれば、必ず全部使う?
ペンギン先生 ペンギン先生
必ずではないよ。max_tokensの説明でも、モデルは上限に達する前に停止する場合がある。多段の処理なら、各呼び出しで実際に使った量と、残りの枠を記録しよう。余裕を配分することと、設定値を全部消費することは別なんだ。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「トークンバジェット」って出てきたら「AIが使うトークン量を、目的に合わせて配分する予算」と思えばだいたいOK!
📖 おまけ:英語の意味
「Token Budget」 = トークン予算
💬 TokenはAIが扱う情報の単位、Budgetは予算という意味だよ。どの範囲の予算かを確かめよう。

参考資料

← 用語集にもどる