TIP
← Research

Research

「パターンマッチング」は人間もLLMも同じ——46モデルと人間を比較した推論研究

2026/10/03

LLMの「パターンマッチング批判」は人間にも当てはまる?

LLM(大規模言語モデル)が推論タスクで失敗したり、問題の表面的な内容によって正答率が変わったりすると、「LLMは本当に推論しているのではなく、単なるパターンマッチングをしているだけだ」という批判がしばしば向けられる。しかしウィスコンシン大学マディソン校の Zach Studdiford と Gary Lupyan は、その批判が人間の推論にも同様に当てはまる可能性を示す論文「Reasoning as Pattern Matching: Shared Mechanisms in Human and LLM Everyday Reasoning」(arXiv:2606.13607)を発表した。

研究の概要:46モデルと人間2コホートを比較

著者らはまず、日常的な因果推論を問う課題を設計し、人間の被験者(計142名、2コホート)と42の公開重みモデルおよび4つのプロプライエタリモデルを合わせた計46のLLMに同じ問題を解かせた。課題は「ガラスがタイルの床に落ちると、カーペットに落ちる場合より割れやすい」といった日常的な因果関係を問うもので、11のカテゴリ(地心的・自己中心的方向関係、物体の物理的特性など)から構成されている。

各シナリオは「ブランク穴埋め」形式で提示され、被験者は2択の補完候補のうち、より蓋然性の高い方を選ぶよう求められた。また、「原因推論」と「結果推論」の2方向から同じ知識が問われる設計になっており、表面的な連想ではなく因果的理解を問うよう工夫されている。

人間もLLMも「内容変化」に脆弱

論文によれば、人間の正答率は平均71%(標準偏差21%)とカテゴリ間で大きなばらつきがあり、性能は「天井」にはほど遠かったという。また表面的に些細なプロンプトの変更が、人間にもLLMにも同様の失敗パターンを引き起こすことが確認されたと報告されている。

具体的な例として著者らが挙げるのは次のようなケースだ。「シカゴはアリの北にある。アリが振り返った。シカゴはアリの___にある」という問いと、「絵画はアリの北にある。アリが振り返った。絵画はアリの___にある」という問いを比較すると、参照物が「シカゴ(都市)」か「絵画」かという違いだけで正答率が変化する。「シカゴ」という単語が地心的(固定した地理的方向)な参照枠を喚起しやすいのに対し、「絵画」は室内の自己中心的な参照枠を連想させやすいためだと著者らは解説する。

さらに著者らは、同じ参加者が同じプロンプトを2度提示された際にも同じ誤りを繰り返し、誤答に対して「正当化」を行うことも確認したと述べており、単なる不注意や当て推量では説明できないと主張している。

ニューロン介入実験:「内容感受性」が人間との一致を生む

行動実験に加えて著者らはLLM内部の表現についても分析を行っている。具体的には、**「内容不変(抽象的構造に反応する)ニューロン」と「内容感受性ニューロン」**を特定し、それぞれの活動が人間の応答パターンとどのように対応するかを調べた。

その結果、LLMは抽象的な表現と内容感受的な表現の両方をエンコードしているものの、人間の応答との整合性をもたらしているのは内容感受性メカニズムであることが因果的介入実験によって示されたと著者らは報告している。すなわち、抽象的な世界モデルではなく、具体的なコンテンツ情報に反応するニューロン群が、モデルを人間らしい応答に導いているということだ。

「パターンマッチングは浅くない」という主張

著者らが提示する理論的立場は、パターンマッチングを「本物の推論ではない代替手段」として捉える従来の見方とは異なる。論文は、パターンマッチングとは神経ネットワークが問題を解く根本的な方式であり、「浅い処理」ではないと主張する。この立場によれば、認知とは「手がかりへの定型的な応答の連鎖から構成される」ものであり(Margolis, 1990)、入力の処理は本質的に文脈依存的で、関係するエンティティについての背景知識を動員するものだという。

こうした観点では、完全な合成性や役割充填独立性(role-filler independence)を欠くことは、パターンマッチングシステムの予測される性質であって欠陥ではない。そして同じことが人間の推論にも当てはまるという。

結果の含意と限界

本研究は、LLMの「パターンマッチング批判」が人間の推論をそのまま反転した鏡像である可能性を示す点で興味深い。ただし著者ら自身も認めているように、行動上の類似性からただちに内部メカニズムの同一性を断定することはできず、「抽象的能力の核が場合によって異なる形で発現している」という解釈の余地も残る。また人間の内部表現はLLMのように直接的に介入・観察できないため、両者の認知機構が本当に同質なのかは引き続き未解決の問題だ。

本論文はarXivにて公開されており(arXiv:2606.13607)、LLM研究者だけでなく認知科学・心理学の研究者にとっても示唆に富む内容となっている。


出典: Reasoning as Pattern Matching: Shared Mechanisms in Human and LLM Everyday Reasoning