AnthropicのClaude Opus 5、上位モデルの半額でベンチマーク0.5%以内の性能差を達成
DRANK

7月24日、Anthropicが「Introducing Claude Opus 5」と題した記事を公開した。新モデル「Claude Opus 5」は、Anthropicが現世代最上位として比較対象に据える「Fable 5」の半額で、コーディング系ベンチマークでは性能差0.5%以内を達成したという。「半額で同等」という主張自体は目新しくない。だが今回のOpus 5が特に注目を集めているのは、ツールを与えられていない状況で自前のコンピュータビジョンパイプラインを構築するなど、計画・実行・検証を自律的にこなすエージェント的なふるまいが複数の実例で確認されている点だ。LLMのコスト競争が激化し、エージェント型AIの実用化が本格化しつつある2026年において、Opus 5はその両方に同時に応えるモデルとして登場した。半額で「Fable 5の0.5%以内」を達成Opus 5の最大の訴求点はコスト効率だ。Anthropicは「Fable 5に近いフロンティア級の知性を、半額で提供する」と明言している。具体的な数字を見ると、ソフトウェアエンジニアリング系ベンチマークFrontier-Bench v0...

by @tf_official
Related Topics: AI AI Code Generator AI Text Generator