「公開ベンチマークは信頼できない」問題に正面から挑む — 自社データでAIモデルを評価できるプラットフォーム「Optima」が登場
DRANK

8月16日、The Decoderが「Optima tackles AI benchmarking's biggest flaw by letting users test models against their own data」と題した記事を公開した。LLMの独立評価機関として知られるArtificial Analysisが新プラットフォーム「Optima」をリリースした。早期テスターの事例では、品質をほぼ損なわずコストを10分の1に削減できるモデルを特定できたという。ユーザー自身のデータを使ってAIモデルをカスタム評価できる仕組みを、以下に詳しく紹介する。

by @tf_official
Related Topics: AI Machine Learning Startup