Googleの新TTSモデル、テキスト指示だけでゼロから音声を設計可能に — 2,000種のプリセット音声・30秒クローン・2声対話に対応
DRANK

9月24日、The Decoderが「Google's new Flash TTS models let you design AI voices from scratch using text descriptions」と題した記事を公開した。ElevenLabsやOpenAI TTSが先行する音声AI市場に、Googleがテキスト記述だけでAI音声をゼロから設計できる新TTSモデル群を投入した。プリセット音声を選ぶだけでなく、声質・アクセント・発声スタイルを自分で指定して新しい声を作れる点が従来のTTSサービスとの大きな違いだ。

by @tf_official
Related Topics: AI Machine Learning AI Music/Voice Generator