AIの「推論モデル」は本当に推論しているのか — 思考の痕跡の30〜60%が答えに無関係という研究が示す不都合な事実
DRANK

7月31日、Quanta Magazineが「Is AI Reasoning Right for the Wrong Reasons?」と題した記事を公開した。この記事では、AIの「推論モデル」が正しい答えを出していても、それが本当に「推論」と呼べるのかという科学的な問いについて詳しく取り上げている。「推論している」のか、それとも「推論らしく見える」だけなのか2024年にOpenAIがo1モデルを発表して以降、大規模推論モデル(LRM: Large Reasoning Model)は急速に存在感を増した。一方で、Appleの研究チームは「思考の幻想(Illusion of Thinking)」と題した論文でLRMの推論能力を根本から疑問視し、サンタフェ研究所はベンチマークを「表面的なショートカット」で突破しているだけだという研究を発表した。Quanta Magazineのサイエンスジャーナリストがこの矛盾に正面から向き合い、複数の研究者に取材した結果をまとめたのが本記事だ。「推論トレース」は本当に推論の証拠なのかLRMの仕組みを簡単に説明する。LRMはLLMを土台に、回答の前に「チェー...

by @tf_official
Related Topics: AI Machine Learning Deep Learning