GPT-6 AstraはコードレビューでGPT-5.6 Solより20%多くバグを検出 — クロスファイル推論の差がコスト2.5倍に見合うか
DRANK

9月4日、CodeRabbitが「GPT-6 Astra review: code review gains, privacy, and cost」と題した記事を公開した。この記事では、OpenAIのGPT-6 AstraをCodeRabbitのコードレビュー評価基準で実測し、バグ検出率・コスト・プライバシー対応を他モデルと比較した結果について詳しく紹介されている。

by @tf_official
Related Topics: AI AI Code Generator Software testing