2026-10-03 09:50
AI123

Tavus发布实时视频交互模型Griffin,称48%通话者误以为对方是真人

2026年10月,AI研究团队Tavus发布实时视频交互模型Griffin,并同步推出研究预览版Griffin-Lite。Tavus公布的一项实验显示,在54名参与者与Griffin-Lite进行的一分钟视频通话中,有26人认为屏幕另一端是真人,占比约48%;作为对照,上一代系统在相同流程下仅41人中的1人被当成真人,比例为2.4%。Tavus据此宣称,Griffin是首个通过实时“视频图灵测试”的模型,并将其归入新类别“人类交互模型”(Human Interaction Model,HIM)。

据Tavus介绍,Griffin采用全双工视频交互方案,能在输出语音和视频的同时持续接收并处理用户的声音与画面。系统由持续对话建模引擎和音视频生成引擎构成,前者以小于一秒的间隔评估交流状态,输出情绪、表情、动作等控制信号;后者将信号转化为连续的声音与画面。Griffin-Lite的视频模块以320毫秒为单位实时生成720p、25帧每秒的视频,语音模块支持流式生成,并可用约10秒参考音频克隆声音。

在Tavus公布的H100测试中,音频到达后画面出现的平均延迟为0.43秒。在英伟达VideoFDB公开榜单上,Griffin-Lite生成赛道总分3.83(人类参考分3.92),感知赛道得分3.73(人类参考分4.20),均领先榜单中其他AI系统,但部分对比对象的输入条件存在差异。此外,Tavus仅向部分可信测试者开放研究预览,尚未供普通客户使用,团队称正在开发AI身份披露功能,并继续开展安全与对齐评估。

来源
  1. 2026-10-09 01:01 | 中国科技网:首次通过“视频图灵测试”,新AI模型在视频对话中的表现几可乱真|总编辑圈点
    阅读原文

    视频截图。图片来源:Tavus官网科技日报记者 张梦然美国旧金山AI视频公司Tavus官网称,该公司最新发布的新模型Griffin-Lite,在组织54名受试者进行一分钟视频通话后,26人误以为对方是真人,占比48%。同样的测试流程下,上一代系统只有2.4%的受试者这样判断。Tavus称,这是首个通过“视频图灵测试”的实时视频对话模型,并把它定义为“人类交互模型”。与传统语音助手不同,Griffin-Lite能在双方同时说话的情况下,实时做出反应,无论是附和还是打断,都如同真人聊天一样。“视频图灵测试”是在实时视频通话场景下检验AI能否在对话中表现得更像真人,受试者不知道对方身份,通过自然交流...

  2. 2026-10-04 18:26 | 新浪:高比例盲测数据是否意味着AI通过实时视频图灵测试?
    阅读原文

    Tavus在2026年10月1日发布的交互模型Griffin,以48%的真人盲测误认率宣称“首次通过实时视频图灵测试”,但这一数据与经典图灵测试的判定标准之间存在显著差异。  一、48%盲测误认率与图灵测试标准的差异  测试形式对比:Griffin的测试由54名受试者与AI进行1分钟实时视频对话,事先不告知对方是AI。而经典图灵测试要求裁判通过纯文本界面与双方交流,限时5分钟,且必须三选一明确判断。  通过率差异:Griffin的48%误认率大幅超越前代同类系统(普遍低于3%),前代Phoenix-4.5仅2.4%。但该数据仍低于传统图灵测试通常认可的“30%误判”通过门槛,也远低于GPT-4...

  3. 2026-10-02 18:31 | 36氪:刚刚,AI击穿了“视频图灵测试”,1700万网友在线围观
    阅读原文

    过去,视频通话常被当成确认身份的一道保险。文字可以代写,声音可以合成,但让对方打开摄像头,聊几句、看表情,似乎总能多一分把握。  如今,连这份眼见为实的笃定也开始受到挑战。  最近,AI 研究团队 Tavus 发布实时视频交互模型 Griffin,并公布了一项实验结果。在与其研究预览版 Griffin-Lite 进行一分钟视频通话后,54 名参与者中有 26 人认为,屏幕另一端坐着一个真人,占比约为 48%。  ▲ 截至发稿前,近 1736 万网友围观  作为对照,Tavus 上一代系统在相同实验流程下,只有 41 人中的 1 人被当成真人,比例为 2.4%。  Ta...

其他新闻

查看全部