【#OpenAI发布GPT-Live#:可边听边说,对话更接近真人聊天】
据IT之家,OpenAI今天发布GPT-Live系列模型,定位新一代全双工语音模型,可同时聆听与说话,让AI对话感觉更接近真人。
架构方面,GPT-Live系列模型采用全双工架构,不再依赖单轮结束后再响应,可在同一时间持续处理输入和输出,模型可“每秒多次”判断是否说话、继续倾听、暂停、打断或调用工具,从而让对话更接近真人聊天体验。
性能方面,相比较此前Advanced Voice Mode,在时长5-10分钟的配对对话中,基于整体偏好、轮次衔接、打断情况、对话流畅度与自然度等衡量指标,GPT-Live-1与GPT-Live-1 mini模型的偏好得分更高。
用户规模方面,OpenAI披露,每周有超过1.5亿人通过Voice和Dictation等功能与ChatGPT语音交互,应用场景包括免手持日常协助、语言练习、睡前故事与通勤闲聊。新版本还支持在语音对话中展示天气、股票、体育等可视化卡片,并继续支持搜索、记忆、图片和文件上传。(视频来源:钛媒体APP)http://t.cn/AXoDZMc0
