OpenAIとAnthropicは自社製テストで自社モデルを採点している — AIベンチマークが構造的に信用できない理由
DRANK

9月12日、PCMagが「Why AI Benchmarks Are Total BS (And How OpenAI and Anthropic Use Them to Trick You)」と題した記事を公開した。この記事では、AIベンチマークが実態とかけ離れており、OpenAIやAnthropicがそれをマーケティングに活用している実態について詳しく論じられている。

by @tf_official
Related Topics: AI Machine Learning Functional Programming