Tavus開発のGriffinがNvidiaのベンチマークで3.83点を獲得し遅延0.43秒でビデオ通話を実現

Por
Tavus AI - Divulgação Foto: Tavus AI - Divulgação

カリフォルニア州サンフランシスコに拠点を置く新興企業のTavusが、リアルタイムで双方向映像を生成する人工知能モデル「Griffin」を公開しました。社内で実施された検証実験において、60秒間のビデオ通話を行ったボランティア54人のうち26人が相手を生身の人間であると認識し、騙された割合は48パーセントに達しました。

2026年10月1日木曜日に披露されたこのシステムは、人間対話モデルと位置づけられています。映像から映像へと直接やり取りするアーキテクチャを採用しており、会話相手の表情や沈黙、細かな挙動をリアルタイムで認識しながら、適切な音声と表情の映像を同時に生成する構造を備えています。

今回の実験結果は、同社が過去に手がけた初期世代の技術と比較して飛躍的な進歩を示しています。41人を対象とした従前の試験では、本物の人間と信じた参加者はわずか1人にとどまり、騙された比率は2.4パーセントでした。以前の手法では、画像処理を担うPhoenix、対話を制御するSparrow、認識を行うRavenという3つの分離したモデルを連結して稼働させていました。

Tavusの共同創業者兼最高経営責任者であるHassaan Raza氏は、今回の技術によって人間とコンピューターの関わり方が抜本的に変化すると説明しています。同氏は、人工知能が高度に進化を遂げた現在でも利用者が機械の都合に合わせる状況が続いていると指摘し、Griffinは人間本来の自然な対話作法を理解して歩み寄るための重要な前進であると語りました。

評価指標VideoFDBにおける測定数値とハードウェア環境

Griffinの処理性能は、半導体大手Nvidiaが策定したリアルタイム音声動画対話向けベンチマーク指標であるVideoFDBにおいても検証が行われました。発話や表情の自然さを測定する表現生成の評価項目で、軽量版にあたるGriffin-Liteは5点満点中3.83点を獲得して首位に立ちました。この数値は他の競合コンピューターモデルが記録した2.80点を大きく引き離し、実際の人間の録画データが持つ3.92点に極めて近い水準です。

視覚情報や音声を正しく把握しているかを評価する知覚領域のテストにおいて、当モデルは3.73点の評価を獲得しました。この記録は従来のコンピューター基準である3.44点を上回ったものの、生身の人間の基準値である4.20点には届いていません。システム処理はNvidia H100画像処理半導体上で実行されており、音声と映像の切り替え遅延を平均0.43秒に抑えることで、違和感のない相づちや自然な割り込み発話を成立させています。

技術陣による実演デモでは、画面内のアバターが手元のルービックキューブを解こうとする被験者に対して、ブロックの位置を確認しながら的確に指示を与える様子が公開されました。アバターは利用者が思考のために手を止めた際にも、自らの解説を一時停止して待機する柔軟な応答を見せました。

開発元が公表した検証結果と運用基盤の概要

  • 公式発表日:2026年10月1日木曜日
  • 開発拠点:アメリカ合衆国カリフォルニア州サンフランシスコ
  • 被験者規模:60秒間の通話を実施した54人
  • Griffin-Liteの欺瞞率:48パーセント(26人が人間と判定)
  • 従来モデルの欺瞞率:2.4パーセント(41人中1人のみ誤認)
  • 平均処理遅延:Nvidia H100チップ稼働で0.43秒
  • 直近の調達資金:CRVが主導したシリーズBラウンドで4000万ドル

対話判定の設計思想とチューリングテストとの乖離

Tavusが実施したテスト環境は、イギリスの数学者Alan Turingが1950年に提唱した標準的なチューリングテストとは異なる方法で設計されました。伝統的な枠組みでは、審査員がテキスト通信を用いて隠蔽された機械と本物の人間双方と対話し、どちらが人工システムであるかを明示的に見極める作業を行います。

一方のTavusの試験では、年間計画について1分間の雑談を行う名目で被験者が集められ、通話相手がアルゴリズムである事実は事前に伏せられていました。対話パートナーが生身の人間であったか否かを尋ねる確認作業は、通話終了後に初めて実施されました。同社の記録によると、アバターの不自然さに気付いた参加者の大半は通話開始から20秒以内に疑念を抱いていました。

この検証プロセスに対しては、被験者を募集した外部プラットフォームの名称が非公開となっている点について独立検証の観点から留意が必要です。オンラインコミュニティでは、査読を伴う学術的な標準プロトコルを満たした第三者機関による完全検証ではないとする指摘も上がっています。

法人利用を標的としたサイバー犯罪の深刻化

リアルタイムで動作する精巧なアバターの台頭は、企業を標的とした詐欺犯罪の抑止に取り組む情報セキュリティ分野に大きな懸念をもたらしています。ZoomやMicrosoft Teamsといった社内コミュニケーションツールは、映像の合成や音声の複製を悪用したソーシャルエンジニアリング攻撃の標的となっています。

2026年の初頭には、Lazarus傘下のサイバー攻撃グループであるBlueNoroffによる不正工作が報告されました。この事例では偽装したビデオ映像を用いて信頼できる業務連絡者を装い、従業員を誘導してスパイウェアをインストールさせる手口が確認されています。暗号資産関連企業や資産管理会社では、採用面接の場において身分証明書の実物を提示させたり近隣の飲食店について質問したりする対面テストを導入し、偽装工作を見破る防衛策を講じています。

利用資格の制限と市場投入に向けた安全管理手順

  • 提供対象:事前審査を通過した評価担当者およびセキュリティ研究者
  • 提供制限対象:一般の小売企業および通常プランの商用エンドユーザー
  • 登録経路:Tavus公式ポータル内の研究アクセス申請フォーム
  • 商用化の前提条件:目視可能な電子透かしの埋め込みと不正防止ロックの実装
  • 料金体系:月額および利用料の設定は非公開
  • 一般提供開始時期:安全審査の進捗に応じるため未定

Tavusは透明性を確保する安全機能の実装が完了するまで、一般市場向けにGriffin-Liteを広く開放しない方針を明らかにしています。同社の研究統括責任者であるIoannis Patras氏と最高業務責任者のQuinn Favret氏を中心とする開発チームは、一般配信に先立ち義務化される識別用ロック機構を確立するため、デジタルガバナンス機関との協議を継続しています。

Notícias relacionadas