【グロッキング】
グロッキング とは?
公開:
💡 迷走した後に突然悟りを開く禅の公案みたいなAI
ニューラルネットワークが一度過学習した後、訓練をさらに続けることで突然汎化能力を獲得する現象。遅延汎化とも呼ばれる。
📌 このページのポイント
ペンギン先生、グロッキングって、なんか具合が悪い感じの名前なの?
過学習ってテストの答えを丸暗記しちゃうやつだよね?そのあとに急に賢くなるってどういうことなの?
そう!普通、過学習したらそのままダメになると思うよね。でもグロッキングでは、さらに訓練を続けると「あるポイント」で検証データへの精度がパッと上がるんだよ。まるで突然悟りを開いたみたいにね。
なんで急に賢くなれるの?訓練データを暗記してたんじゃなかったの?
モデルの内部を分析すると、過学習期には「暗記回路」と「汎化回路」の両方が同時に作られていることがわかったんだよ。訓練初期は暗記回路の方が効率的だから使われるけど、長く訓練すると汎化回路が最適化されて主導権を握るんだね。
じゃあ早期停止で訓練をやめちゃうと、グロッキングを見逃しちゃうってこと?
実際の大きなAIモデルにも起きることなの?
主に小さなモデルや限定的なタスクで観察されているけど、大規模モデルの解釈可能性研究にも影響を与えているよ。「どうやって汎化が起きるか」を理解する手がかりとして、メカニスティック・インタープリタビリティの研究者が注目しているんだ。
まとめ:ざっくりこれだけ覚えればOK!
「グロッキング」って出てきたら「過学習の後に急に賢くなる謎現象」と思えばだいたいOK!
📖 おまけ:英語の意味
「Grokking」 = 深く理解する
💬 SF小説「異星人の客(Stranger in a Strange Land)」で生まれた造語で「完全に理解・同化する」意味だよ