Claudeと同精度のオープンモデルが5.4倍安い — AIコーディングベンチマークで見えた「高いモデルを使う理由」の縮小
DRANK

8月21日、Together AIが「GLM-5.3 vs. Claude Fable 5 on DeepSWE: Cost, Coding, and Routing」と題した記事を公開した。ソフトウェアエンジニアリングベンチマーク「DeepSWE」を用いて、GLM-5.3とClaude Fable 5(Anthropicのクローズドモデル)の精度・コスト・使い分け戦略を比較している。初回精度はほぼ同着でありながら、コストは5.4倍の開きがある——この事実が意味するところを、ベンチマーク結果と実運用上のルーティング戦略から掘り下げた内容だ。

by @tf_official
Related Topics: AI AI Code Generator Machine Learning