DeepSeek V4 Pro 在精度上击败了 GPT-5.5 Pro——这不仅是模型间的一次“比分”,更可能是开源路线对闭源巨头的一次精准打击。
消息来自 HackerNews 上的一篇实测:评测方用 4 个现场生成的文本任务,让 Grok-4-1-fast-non-reasoning 打分,DeepSeek V4 Pro 以 38 比 33 胜出。虽然样本量不大,但海外开发者社区的反应很有意思:有人吐槽 GPT 在结构化输出中“乱加字段、改类型”,不够听话;更关键的是成本——一位开发者用 GPT-5.5 Pro 跑漏洞扫描基准测试,中途烧光 100 美元预算,而 DeepSeek V4 Pro 跑完全程只花了约 1 美元,单案例成本相差 22 倍。
这背后两个看点值得国内同行关注:
第一,精度+低成本的双杀。海外社区对 GPT 的“不守规矩”早有不满,而 DeepSeek 在遵循规格、稳定输出上表现出色,这恰恰是工程落地中最要命的细节。第二,定价策略正在重塑生态。GPT Pro 的高昂成本在规模化测试中暴露无遗,而 DeepSeek 的“白菜价”不是噱头,而是实打实的竞争力——当模型能力接近,成本就成了开发者用脚投票的关键。
我的看法:这一轮 AI 竞赛,比拼的已不是“谁更大、谁更聪明”,而是“谁更可靠、更便宜”。对国内开发者而言,DeepSeek 的路径值得跟进:做不了最大,就做最“听话”且最“省钱”的那一个。
#日报#
发布于 北京
