
GPT Live功能在ChatGPT哪个版本才能使用?
一、GPT-Live的发布背景与时间
GPT-Live于2026年7月9日由OpenAI正式发布,旨在取代此前ChatGPT的Advanced Voice Mode,让AI语音交互更接近真实对话。
该模型采用全双工架构(full-duplex),能够同时听和说,每秒进行多次决策以决定是否继续听、打断、停顿或挂断。

二、GPT-Live在ChatGPT的版本支持情况
- 用户类型
- 默认使用的GPT-Live版本
- 功能说明
- Free用户GPT-Live-1 mini可体验基础的实时语音对话,具备自然打断与倾听能力
- Go、Plus、Pro用户GPT-Live-1完整功能,支持后台调用GPT-5.5进行搜索、推理等复杂任务
- 所有用户语音按钮入口在ChatGPT App中点击语音图标即可开启对话
官方表示,GPT-Live已面向全球ChatGPT用户推送,无需额外订阅或升级版本。
在后台,GPT-Live遇到需要深度推理或网络搜索的问题时,会调用GPT-5.5等前沿模型完成任务,同时保持语音对话不中断。

三、“能自己挂电话”的技术原理
全双工架构使GPT-Live能识别对话的自然终结信号。当用户表达“没事的话我先挂了”或长时间沉默时,模型可自主判断并执行挂断动作。
它不仅会主动结束通话,还能在对话中检测用户是否走神,例如用户与他人交谈时,它会询问“你有在听吗?”。
这一能力源于每秒多次的实时决策机制:模型持续分析语音节奏、语气和语义,动态调整自己的回应方式,包括加入“嗯”“是啊”等倾听词和适当沉默。
四、GPT-Live的典型应用场景
口语练习:用户可将其作为雅思或英语口语教练,进行实时对话并获取反馈,有效降低辅导成本。
同声传译:支持多语言实时互译,适用于国际会议、商务洽谈等场景,翻译过程中能自然打断和接话。
工作助手:在驾车、散步等场景中通过语音记录灵感、梳理项目、模拟面试,碎片时间产出显著提升。
情绪陪伴:用户可与GPT-Live进行深度心理交流,它能够记住长期对话的上下文,并给出共情回应。
五、用户反馈与拟人化体验
大量用户表示,GPT-Live的语调、停顿、咳嗽等细节与真人几乎无异,甚至因过于逼真而感到“细思极恐”。
有用户分享:“聊着聊着他说没事的话他就先挂了,我以为只是口嗨,结果真给挂了,直接通话结束。”
这种主动挂断的行为被认为是AI交互从“被动响应”向“主动社交”跨越的重要标志,提升了沉浸感,但也引发了对拟人化边界的讨论。
OpenAI同时为GPT-Live重新制作了9种不同的语音,进一步增强自然度。
六、注意事项与未来展望
GPT-Live目前尚不支持在ChatGPT中进行语音通话或屏幕共享,但官方表示正在开发中。
用户可随时在对话中要求GPT-Live放慢语速、暂停思考,或通过设置关闭记忆功能来保护隐私。
随着全双工架构的成熟,未来AI语音助手有望在客服、教育、医疗、文旅等领域实现更流畅的人机协作,持续降低技术使用门槛。