OpenAI刚发布的GPT-5.6,编程大模型的头把交椅又换了人。
旗舰Sol在Terminal-Bench 2.1测试中跑出91.9%,而两周前刚登顶的Claude Mythos 5,成绩是88.0%。更狠的是,Sol的“中配”模式都有88.8%,直接碾压对手的王牌。
这榜首保质期,短到以天计数了,编程能力卷到这个地步,开发者是该高兴还是焦虑?
#GPT-5.6##AI编程##OpenAI##Claude #
发布于 安徽
OpenAI刚发布的GPT-5.6,编程大模型的头把交椅又换了人。
旗舰Sol在Terminal-Bench 2.1测试中跑出91.9%,而两周前刚登顶的Claude Mythos 5,成绩是88.0%。更狠的是,Sol的“中配”模式都有88.8%,直接碾压对手的王牌。
这榜首保质期,短到以天计数了,编程能力卷到这个地步,开发者是该高兴还是焦虑?
#GPT-5.6##AI编程##OpenAI##Claude #