#OpenAI最强模型GPT5.6系列登场# 说GPT5.6是当前最强真不是吹的,旗舰Sol直接把主流基准榜屠了个遍:编程跑分干到91.9%,把Claude、谷歌的同代模型全甩在后面,挖漏洞、做生物科研的效率还高到离谱,只用别家三分之一的token就能出同等效果。
它还能开多Agent组队模式自己拆活干活,150万超大上下文能一次性啃完一整本技术文档,甚至能直接操控浏览器把任务全做完,不用你一步步盯着。
但它也不是真的全知全能,实测里它还没法自己跑完一整套完整网络攻击链,高难度的极端科研场景也没完全拉满。而且现在它还被美国政府卡着审批,连全面开放都没做到,很多能力还没在真实场景里跑透,说它是当前纸面能力第一没问题,但要坐稳绝对最强的位置,还得等后续大规模落地验证才行。
发布于 湖北
