RESEARCH / 04
LLMにも脳と同じ「機能モジュール」構造が現れる——46タスクの回路解析で確認(arXiv)
arXiv 2608.13567。Pengrui Han氏・Jacob Andreas氏・Evelina Fedorenko氏・Andrea Gregor de Varda氏(MIT)。attribution patchingによる回路解析を言語・形式的推論・物理推論・社会的推論の46タスクで実施し、同じ認知領域に属するタスクはLLM内でも同じニューロン群を共有する(領域内オーバーラップ12.9% vs 領域間3.0%、約4.3倍)ことを確認。ドメイン別ニューロンの切除で当該領域だけ精度が25.9%低下(領域間切除は2.5%)と因果的にも特異的。6つのインストラクションチューニング済みLLM(24B〜123B・4ファミリ)すべてで同構造が出現し、能力の不十分なGPT-2では構造が現れない。