#赛博茶馆[超话]#OpenAI凌晨三连炸:GPT-5.6、GPT-Live、ChatGPT Work,这次真的是「全栈帝国」了
昨晚到今天凌晨,OpenAI一口气丢出了三颗重磅炸弹:GPT-5.6全系列模型正式开放、GPT-Live语音模型全球上线、ChatGPT Work桌面应用发布。作为一个跟了大模型赛道三年多的人,说实话,这次的发布密度和战略纵深让我有点被震到了。
先说最核心的——GPT-5.6。这次不是单一模型,而是三个规格同时开放:旗舰版Sol、均衡版Terra、性价比版Luna。定价体系也很清晰,Sol版输入$5/输出$30每百万Token,Terra版$2.5/$15,Luna版$1/$6。三个模型覆盖从重度推理到日常对话的完整场景,这说明OpenAI已经从「一个模型打天下」转向了产品矩阵思维。
但真正让人倒吸一口凉气的,是Sol的底层硬件。根据各方爆料和技术推演,Sol的参数量约3万亿,激活参数约1500亿,但它不是跑在传统GPU集群上,而是横跨70到100张Cerebras晶圆级芯片——每一层神经网络单独部署在一整张晶圆上。推理速度达到了惊人的750 Tokens/s,相当于一秒输出500多个汉字。这意味着过去需要等几分钟的多步Agent操作,现在眨眼完成。
更劲爆的是,OpenAI同时曝光了自研推理芯片Jalapeño。从画第一根线到流片只用了9个月,由OpenAI操刀架构、博通负责实现与互联、Celestica做系统集成。这颗芯片专为大模型推理设计,不仅跑自家模型,还兼容全行业LLM。用墨西哥辣椒命名,意思是这只是开胃菜。
再看GPT-Live。这次OpenAI把语音交互推进到了全双工架构——AI可以同时听和说,会用「mhmm」「yeah」这样的语气词表示在听,也能在你思考时保持安静。最关键的是,它在处理搜索、推理等深度任务时,可以把任务委派给GPT-5.5这样的后台模型,自己继续和你聊天,不会卡住。这已经不是语音助手了,更像是一个真正能对话的同事。
最后是ChatGPT Work。这个产品把聊天、工作文档、Codex整合到一个桌面应用里,可以创建文档、电子表格、演示文稿甚至Web应用。由GPT-5.6驱动,首批面向Pro/企业/教育用户开放。本质上,OpenAI在用AI重做Office。
这三件事放在一起看,OpenAI的战略意图非常清晰:模型自己训、芯片自己设计、推理自己优化、产品自己做。它要建的不是一个AI公司,而是一个垂直整合的全栈AI帝国,比Apple和Google还要激进。
当别人还在争论开源还是闭源的时候,OpenAI已经在硬件层、模型层、产品层同时下注了。这场竞赛的门槛,正在以肉眼可见的速度拉高。
一个值得思考的问题:当AI的推理速度突破750 tokens/s,当语音交互达到全双工实时,当Agent操作不再被延迟卡脖子——我们日常工作中最先被颠覆的,会是什么?
#GPT5.6 #OpenAI #GPTLive #ChatGPTWork #AI #赛博茶馆#
发布于 北京
