网通社科技快报
AI虚拟助手Griffin视频通话以假乱真近半数人误认
近日,美国人工智能公司Tavus推出全新AI模型Griffin,该模型在视频通话场景下表现惊艳。据官方测试数据显示,在54名参与者的实验中,有26人(占比约48%)误以为屏幕另一端是真人而非AI虚拟助手,远超上一代系统仅2.4%的识别率。Griffin的核心创新在于采用全双工视频交互方案,可同时进行语音输出与接收处理,使模型能在用户说话时实时生成回应,无需等待对方发言结束。
在一段演示视频中,Tavus联合创始人Hassaan Raza与虚拟助手Vanessa进行了长达一分钟的对话。Vanessa不仅能够理解Raza的表情和语气,还能适时做出点头、微笑等自然反应,甚至在Raza提到自己穿着二手衣服时,Vanessa幽默地回应说"我会保持呼吸平稳,以免耗尽你的CPU"。这种高度拟真的交互效果得益于Griffin的两个主要技术模块:持续对话建模引擎和音视频生成引擎。前者以小于一秒的间隔重新评估交流状态,后者则负责将决策转化为连续的声音和画面,确保整个交互过程的流畅性。
此外,Griffin还具备强大的视觉生成能力,可以从一张参考图像出发,实时生成包括人物面部表情、手势动作以及背景环境在内的完整画面。这项技术的进步不仅体现在交互的自然度上,更在于它对传统视频通话模式的颠覆。随着AI技术的发展,视频通话作为确认身份的最后一道防线也开始变得脆弱。Griffin的成功表明,AI已经能够模拟人类的非语言交流特征,如眼神接触、面部表情变化和肢体语言,从而使虚拟助手在视频通话中几乎可以以假乱真。
尽管Griffin目前仍处于预览阶段,但其表现已经引起了广泛关注。业内人士认为,这项技术的突破将推动AI数字人在更多领域的应用,从客户服务到远程教育,再到虚拟社交,都有可能迎来新的变革。然而,这也引发了关于隐私保护和伦理问题的讨论,特别是在AI能够如此逼真地模仿人类行为的情况下,如何确保用户知情权和数据安全成为亟待解决的问题。
总的来说,Griffin模型的发布标志着AI数字人在交互能力上的重大突破,它不仅展示了AI技术的巨大潜力,也为未来的数字人发展指明了方向。
在一段演示视频中,Tavus联合创始人Hassaan Raza与虚拟助手Vanessa进行了长达一分钟的对话。Vanessa不仅能够理解Raza的表情和语气,还能适时做出点头、微笑等自然反应,甚至在Raza提到自己穿着二手衣服时,Vanessa幽默地回应说"我会保持呼吸平稳,以免耗尽你的CPU"。这种高度拟真的交互效果得益于Griffin的两个主要技术模块:持续对话建模引擎和音视频生成引擎。前者以小于一秒的间隔重新评估交流状态,后者则负责将决策转化为连续的声音和画面,确保整个交互过程的流畅性。
此外,Griffin还具备强大的视觉生成能力,可以从一张参考图像出发,实时生成包括人物面部表情、手势动作以及背景环境在内的完整画面。这项技术的进步不仅体现在交互的自然度上,更在于它对传统视频通话模式的颠覆。随着AI技术的发展,视频通话作为确认身份的最后一道防线也开始变得脆弱。Griffin的成功表明,AI已经能够模拟人类的非语言交流特征,如眼神接触、面部表情变化和肢体语言,从而使虚拟助手在视频通话中几乎可以以假乱真。
尽管Griffin目前仍处于预览阶段,但其表现已经引起了广泛关注。业内人士认为,这项技术的突破将推动AI数字人在更多领域的应用,从客户服务到远程教育,再到虚拟社交,都有可能迎来新的变革。然而,这也引发了关于隐私保护和伦理问题的讨论,特别是在AI能够如此逼真地模仿人类行为的情况下,如何确保用户知情权和数据安全成为亟待解决的问题。
总的来说,Griffin模型的发布标志着AI数字人在交互能力上的重大突破,它不仅展示了AI技术的巨大潜力,也为未来的数字人发展指明了方向。