Tavus、人間と見分けがつかないAI対話モデル「Griffin」発表
Tavusがリアルタイム対面会話に対応するAIモデル「Griffin」を発表した。1分間のビデオ通話後に48%の相手が人間と信じたとの検証結果があり、Nvidiaの独立テストでも人間に近いスコアを記録している。
Tavusが新しいAIモデル「Griffin」を発表した。同社が「Human Interaction Model(HIM)」と呼ぶこのモデルは、リアルタイムの対面会話を理解・実行する初のモデルとして位置づけられている。検証テストでは、1分間のビデオ通話を終えた相手の48%が、Griffinを実在する人間だと信じたという結果が出ている。
音声・表情・ジェスチャーを同時に処理
Griffinは、音声、顔の表情、声のトーン、ジェスチャー、会話の間(ま)といった複数の要素を同時に処理しながら、ビデオを受信・生成する双方向の会話システムだ。従来のAIアバターが音声応答を中心に設計されていたのに対し、Griffinは対面会話で人間が自然に行っている非言語的なやり取りまで含めて再現しようとしている点が特徴となる。
Nvidiaの独立テストでも高評価
性能を示す数字として、1分間のビデオ通話後に48%の相手が実在の人物だと信じたという結果が示されている。従来システムでは同様の検証で2%程度だったとされ、大幅な向上といえる。Nvidiaによる独立テストでは、Griffinが5点満点中3.83点を獲得した。これは実際の人間が記録した3.92点に近く、従来のAIモデルの2.80点を大きく上回る。
営業支援から対人スキル練習まで応用を見込む
Tavusは2020年に設立されたサンフランシスコの企業で、これまでに約6,400万ドルを調達している。もともとは営業・マーケティング向けのAIビデオ技術を手がけており、今回のGriffinでデジタル人格による対話システムへと事業の幅を広げた。想定される用途としては、チュータリング、難しい対話の練習、カメラを使ったテクニカルサポートなどが挙げられている。
人間と見分けがつかないレベルのAIアバターは、実用面での可能性とともに、なりすましや誤解を招くリスクも併せ持つ。Tavus自身も安全性の確認が必須としており、現時点でのプレビュー版は限定されたテスターのみが利用できる状態だ。実用化が進む前に、どのような開示・同意の仕組みを整えるかが問われることになる。