AIの「外側」を進化させたらAGIベンチマークが95.5%に到達 — モデルの重みに触れずにスキャフォールドだけでスコアを更新
DRANK

9月8日、startuphub.aiが「Self-Improving Harnesses Push ARC-AGI to 95.5%」と題した記事を公開した。注目すべきは、モデルの重みをいっさい変更せず、LLMを包む実行環境(ハーネス)を進化させるだけで、ARC-AGIベンチマークのスコアが**95.5%**に到達したという事実だ。fine-tuningも大規模な推論コンピュートの投入も不要——この結果は、「モデルを強くする」以外の道がAGIベンチマーク攻略において本格的に機能し始めたことを示している。

by @tf_official
Related Topics: AI Machine Learning Deep Learning