Metaが「ずっと聞き続けるAI」の基盤モデルを公開 — 単語誤り率3.1%・0.16秒遅延で業界最高水準、価格は競合の最大3分の1以下
DRANK

9月6日、The Decoderが「Meta's new real-time audio model is the foundation for AI assistants that never stop listening」と題した記事を公開した。MetaのSuperintelligence Labsが公開したリアルタイム音声文字起こしモデル「Muse Voice Transcribe」は、AIグラスを通じて会話を聞き続けるパーソナルAIエージェントの基盤技術として設計されており、常時リスニングというコンセプトが現実のインフラとして具体化しつつある。誰かが常に聞いているというプライバシー上の緊張感を技術が追い越し始めた、という文脈でも注目に値するモデルだ。

by @tf_official
Related Topics: AI Machine Learning VR / AR / MR