数码新声
Griffin模型在哪些场景中可以实际应用?
一、从“能对话”到“像真人”:Griffin 想证明什么
全双工实时交互:Griffin 属于端到端 video-to-video 的全双工系统,能一边说话一边监听和观察用户的表情、停顿与手势,既支持被打断,也能主动插话。
多模态同步拟真:模型在对话过程中同步生成人脸表情、肢体动作和语音,模拟真人面对面交流的完整状态。
通过视频图灵测试:内部真人盲测中,54 位受试者在不被告知对方是 AI 的情况下进行 1 分钟实时视频对话,48% 误认为对面是真人;而前代系统通过率普遍低于 3%。
二、在哪些场景中可以实际应用
AI 虚拟教师与模拟对话演练:可承担语言教学、面试训练等任务,利用拟真对话环境帮助学习者提升表达与应变能力。
远程虚拟客服:以真人形象提供面对面的客户服务,结合表情与语音反馈,提升服务温度和沟通效率。
沉浸式虚拟人物实时交互:用于虚拟偶像、数字人陪伴、虚拟导览等场景,实现更自然的人机互动体验。
三、客观验证与安全考量
NVIDIA 基准排名第一:在 NVIDIA VideoFDB 全双工 AI 视频基准上,Griffin 综合得分 3.83/5,位列第一;真人参考基线为 3.92,此前公开最优基线仅为 2.80。
负责任地推进部署:团队承认高度拟真视频存在欺骗与滥用风险,因此在完善披露机制与安全防护之前,不会向全部客户开放,目前仅限少量可信内测人员访问。