SalesforceのRAGが「実文書46%」の壁を乗り越えた方法 — パース改善だけで19ポイント回復、最終的に90%超を達成
DRANK

9月10日、Salesforce Engineeringが「Enterprise AI Accuracy: Building a More trustworthy RAG Application」と題した記事を公開した。標準ベンチマークでは精度90%超を記録していたRAGパイプラインが、複雑なエンタープライズ文書に対しては約46%まで落ち込むという現実に直面したSalesforceのチームが、パイプラインの各ステージを段階的に診断・改善することで最終的に90%超を達成するまでの実装記録だ。「なぜ本番環境でRAGは壊れるのか」という問いに、再現性のある方法論で答えている。

by @tf_official
Related Topics: AI Machine Learning AI Text Generator