10月2日、The Decoderが「Nearly half of test subjects mistook Tavus' AI video avatar for a real person on a one-minute call」と題した記事を公開した。サンフランシスコのAIスタートアップTavusが発表した新モデル「Griffin」が、1分間のビデオ通話で被験者の約半数に「本物の人間」と誤認されたという実験結果を伝えており、AIアバター技術の質的な転換点として注目を集めている。
「人間に間違えられた」AIアバターの数字
Tavusが同社初の「Human Interaction Model(HIM)」カテゴリとして位置づける新モデル「Griffin」を発表した。HIMとは、リアルタイムで対面会話を理解・継続するために設計されたモデルカテゴリであり、これまでの「音声認識+映像生成の組み合わせ」とは異なる統合アーキテクチャを想定したTavus独自の分類だ。LLM(大規模言語モデル)やVLM(ビジョン言語モデル)といった既存カテゴリに対して、対面インタラクション特化型のモデル群を新たに定義しようとする試みといえる。
最も注目すべき数字はこれだ。Tavus自身が実施した調査で、被験者の48%が1分間のビデオ通話後にGriffinを本物の人間だと信じた。この調査はTavusによる自社実施であり、独立した第三者機関による検証ではない点には留意が必要だ。それでも、従来システムでの最高値が**2%**だったことと比較すれば、その開きは際立っている。
さらに、Nvidiaの研究チームが設計・実施した独立評価テストでは、音声・映像を使ったリアルタイム会話において「どれだけ人間らしく感じられるか」を5点満点で測定した結果、Griffinが3.83点を記録した。このテストにおける実際の人間のスコアは3.92、従来の最高AIモデルのスコアは2.80であり、GriffinはAIと人間の差をほぼ埋める水準に達している。
Griffinの技術的な特徴
Griffinは単純な音声認識+映像生成の組み合わせではなく、以下の要素を同時にリアルタイム処理する設計だという。
- 音声・発話内容
- 表情
- 声のトーン
- ジェスチャー
- 間(ポーズ)
従来のアバターシステムが「受信→処理→生成」を逐次的に行うのに対し、Griffinは受信と生成を並行して処理することで、対話のラグや不自然な間を低減している。この設計が「人間らしさ」の知覚に直結しているとTavusは説明している。
現時点での提供状況とユースケース
現在は「Griffin-Lite」と呼ばれるプレビュー版が一部テスターに限定公開されており、より高性能なフルバージョンは「安全性に関する懸念が解消された後」に提供予定だという。Tavusが挙げる想定ユースケースは以下の3つだ。
- チュータリング(個別指導)
- 難しい会話の練習
- カメラを使ったテクニカルサポート
なお、安全性への配慮として段階的リリースを採用していること自体、この技術の持つリスクをTavus自身が認識していることの表れでもある。
Tavusの背景と競合状況
Tavusは2020年創業で、累計調達額は約6,400万ドル。もともとセールス・マーケティング向けのパーソナライズAI動画生成からスタートし、その後デジタルペルソナとのライブビデオ会話へと事業を拡張してきた。
AIアバター・デジタルヒューマン領域では、HeyGenやSynthesia、D-IDといったプレイヤーがすでに市場を形成しているが、これらの多くは非リアルタイムの動画生成が主軸であり、リアルタイム双方向会話に特化したHIMカテゴリはTavusが新たに切り開こうとしているポジションだ。Griffinの詳細はTavusの研究レポートで公開されている。
「人間と区別できない」の閾値と倫理・規制の問い
48%という数字が示すのは、**チューリングテスト的な意味での「区別困難性」が、短時間のビデオ通話という日常的なシーンで現実のものになりつつある**という事実だ。チューリングテストとは、機械が人間と区別できないほど知的な応答を示せるかを問う古典的な評価概念であり、テキストチャットの文脈では議論が続いてきたが、双方向ビデオ通話という高難度のモダリティでその境界が揺らぎ始めている。2%から48%への跳ね上がりは段階的な進歩ではなく、質的な変化と見るべきだろう。
一方で、この技術が広く普及した場合の倫理・規制面での課題は大きい。なりすまし・詐欺への悪用、採用面接や本人確認プロセスへの影響、そしてディープフェイク検出技術との軍拡競争など、技術の進歩に制度が追いつけるかが今後の重要な問いとなる。EUのAI Actをはじめとする規制議論においても、リアルタイム生成AIアバターの開示義務や使用制限は主要な論点の一つになりつつある。
詳細はNearly half of test subjects mistook Tavus' AI video avatar for a real person on a one-minute callを参照していただきたい。