推文
@crazyox · 2026-10-11 04:08
一家叫 Tavus 的公司,刚发布了能实时视频对话的 AI 模型 Griffin。他们自己做的测试里,一分钟通话后,54 个人里有 26 个(48%)以为对面是真人。 这个数字来自公司自己的研究。参与者被告知会和另一个人聊一分钟“今年最期待什么”,实际对面是 Griffin-Lite。 通话结束后才被问有没有怀疑过是 AI。相信是真人的人平均信心是 79%,相信是 AI 的人平均 81%。更早的系统在同样测试里只有 1/41(约 2.4%)被当成真人。 Tavus 称它是第一个“人类交互模型”,能同时处理语音、表情、手势、停顿,还能被打断后接着聊。 目前还只是研究预览,公司说会先做安全和披露机制再开放。但它已经在一些报道里被直接说成“能过视频图灵测试”“面试时能骗人”。 这个结果最值得注意的地方,不是“AI 又更像人了”,而是它把“实时、多模态、可交互”的门槛直接拉到了“一分钟就能骗过将近一半人”。 过去数字人大多是“一眼假”,或者需要预设脚本。 现在是边听边生成视频,能对表情和打断做出反应。 测试里很多人根本没往“可能是 AI”上想。当这种能力被用到远程面试、客服、销售、社交时,对方很难在短时间内判断自己面对的是不是真人。 更现实的问题是,它还没大规模开放,就已经有公司自己用它来宣传“通过了视频图灵测试”。 而真实招聘场景里,已经有过用换脸或深度伪造过面试的案例。 一旦这种实时生成的能力变得便宜又易用,企业的面试风控、平台的身份验证、普通人对“对面是人”的默认信任,都会被重新挑战。 当 AI 不仅能生成内容,还能以几乎无法在短时间里被识破的方式进行实时互动时,过去依赖“见面/视频即真人”的很多场景,恐怕都要重新算账了。 你对面的是人还是AI可能只能通过身份确认之后才能确定了。
曝光 344 · 评论 0 · 点赞 3 · 书签 1 · 曝光/时 15.946095808868758