GoogleがリアルタイムAI音声対話モデル「Gemini 3.8 Live」を公開 — 推論しながら会話を止めない設計で音声エージェント評価1位を獲得
DRANK

9月16日、Tom OuyangとMalini Jaganathan(Gemini Audio Team)が「Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking」と題した記事を公開した。今回発表されたのは、リアルタイム音声対話に特化した2つの新モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」だ。なかでも注目すべきは後者が持つ「考えながら話す」設計で、多段階推論を実行しながら会話を止めないという従来の音声AIが抱えていた課題への直接的な解答となっている。Artificial AnalysisのSpeech to Speech Quality Indexでは総合1位(スコア82.6)を獲得しており、単なる性能向上にとどまらない設計上の転換点として注目に値する。

by @tf_official
Related Topics: AI Machine Learning Google Cloud