7月26日、Techstrong.aiが「Anthropic Debuts Claude Opus 5, Balancing High Performance with Lower Costs and Stricter Safety」と題した記事を公開した。AnthropicがフロンティアモデルClaude Opus 5をリリースし、既存のプレミアムクラスモデルと比べて半額のコスト構造を維持しながら、安全設計と高い性能を両立させようとしている点を詳しく紹介している。
フロンティア性能をほぼ同等のコストで
Claude Opus 5の最大の特徴はコスト構造だ。入力トークン100万件あたり5ドル、出力トークン100万件あたり25ドルという価格設定で、Anthropicはこれを「同社のプレミアムモデル比で半額」と位置づけている。比較対象は同社の上位ティアモデルであり、価格帯の異なる他社製品との単純比較ではない点に注意が必要だ。
サブスクリプション面では、月額100ドルの「Claude Max」プランのメインエンジンとして機能し、月額20ドルの「Claude Pro」プランでも利用可能だ。エンタープライズ向けの日常的な知識業務やコーディングタスクを想定した設計である。
性能面では、元記事によれば同社の別フロンティアモデルとほぼ同等かそれ以上のベンチマーク結果を達成しており、劣るのは法律・医療などの特化領域にとどまるとされる。OpenAIの上位モデルとの直接比較では、エージェント型コーディング(AIが自律的にコードを生成・実行するタスク)を除くほぼ全カテゴリでOpus 5が上回ったと記事は伝えている。
速度・問題解決能力でも差別化
未知のタスクに対する問題解決速度も強調されている。元記事によれば、未学習の課題に対するテストでは次点モデルと比べて約3倍高速な処理を実現しており、さらに別の比較指標では競合の上位モデルに対してスコアで約4倍の差を記録したとされる。ただし「速度」と「スコア」はそれぞれ異なる評価軸であり、いずれも元記事が引用するAnthropicの発表に基づく数値である。
Anthropicは「一般公開モデルとして科学研究に最も適したモデル」と位置づけているが、生物学などの専門ベンチマークでは元記事中に言及される別の非公開モデルが依然トップとなっているとも記されている。
安全設計:攻撃的なサイバーセキュリティ機能をあえて外した
Opus 5リリースで特筆すべきは、意図的な機能制限だ。Anthropicは攻撃的なサイバーセキュリティのトレーニングをOpus 5に含めなかった。システムの脆弱性を発見する能力は維持しているが、エクスプロイト(脆弱性を突いた攻撃コードの実行)能力は意図的に抑制されている。
この判断の背景として、元記事は自律型AIエージェントに関連するセキュリティインシデントの増加を挙げている。記事では「記録的に低い欺瞞行動の発生率」および「ジェイルブレイクや悪意あるプロンプト操作への耐性強化」をもって、AnthropicがOpus 5を「最も安全なモデル」と表現しているとされる。
ジェイルブレイクとは、AIモデルの安全フィルターを意図的に回避しようとするプロンプト操作の総称であり、フロンティアモデルの安全評価における主要な試験項目となっている。Anthropicが公表しているResponsible Scaling Policyにおいても、こうした攻撃的機能の取り扱いは重点評価項目として位置づけられている。
なぜ今このタイミングか
コスト圧力はAnthropicの競合も含めた業界全体の課題になっている。元記事によれば、Uberは2026年分のAIバジェットをわずか4ヶ月で使い切り、経営陣がROI(投資対効果)の明確化を求める事態になったという。こうした大企業側のコスト意識の高まりは、AI提供側の価格競争を加速させる一因となっている。
また、海外スタートアップが投入した低価格帯モデルの台頭など、低コスト競合が市場に相次いで参入している。Opus 5はこうした市場環境を背景に、性能・コスト・安全性のバランスを軸に企業クライアントの維持・獲得を狙う戦略的リリースと言える。
エンタープライズ向けAI導入においては、モデルの性能単体よりも「安全性の説明責任」と「コスト予測可能性」が選定基準として重みを増している。Opus 5のポジショニングはその両面に応えようとするものであり、今後の競合各社の価格・安全設計への対応が注目される。
詳細はAnthropic Debuts Claude Opus 5, Balancing High Performance with Lower Costs and Stricter Safetyを参照していただきたい。