t0data铁马哥
26-06-27 07:43 微博认证:科技博主

OpenAI刚发布的GPT-5.6,编程大模型的头把交椅又换了人。

旗舰Sol在Terminal-Bench 2.1测试中跑出91.9%,而两周前刚登顶的Claude Mythos 5,成绩是88.0%。更狠的是,Sol的“中配”模式都有88.8%,直接碾压对手的王牌。

这榜首保质期,短到以天计数了,编程能力卷到这个地步,开发者是该高兴还是焦虑?

#GPT-5.6##AI编程##OpenAI##Claude #

发布于 安徽