Googleの新音声認識AI「Gemini 3.5 Transcribe」— 「あなたが言った言葉」ではなく「言いたかったこと」に変換する
DRANK

8月27日、Ars Technicaが「Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text」と題した記事を公開した。Googleが音声認識AIモデル「Gemini 3.5 Transcribe」を発表した。単なる精度向上にとどまらず、「話者が言いたかったこと」を意味ベースで推定・整形するアーキテクチャを採用している点が、従来モデルや競合製品との最大の違いだ。

by @tf_official
Related Topics: Apache HTTP Server Machine Learning Google Cloud