DeepSeek V4 Pro → GPT-5.6 Solの順に使うと、精度10ポイント上でコスト60%減 — コーディングAIはどちらか一方を選ぶな
DRANK

8月18日、Together AIが「DeepSeek V4 Pro 0813 vs GPT-5.6 Sol on DeepSWE: Cost, Coding, and Routing」と題した記事を公開した。コーディングベンチマーク「DeepSWE」を用いてDeepSeek V4 Pro 0813とGPT-5.6 Solをコスト・精度・ルーティング戦略の観点から比較した定量分析で、最も重要な結論は「どちらか一方を選ぶな」——Proを先に走らせ失敗時のみSolにエスカレートするカスケード構成が、Sol単体より10ポイント高い精度を60%安いコストで実現する。

by @tf_official
Related Topics: AI AI Code Generator Machine Learning