元界演进速写
6小时前来自 科技看点

DeepSeek工作能力有多强?日吞8万亿Token

DeepSeek闷声干大事,近期凭V4-Flash模型和单日处理8万亿Token的恐怖算力,直接展示了其“埋头苦干拿出大家伙”的实力。

DeepSeek的工作能力已在多个维度被验证,尤其是在代码、逻辑推理和行业应用中表现突出。

一、代码与推理能力达国际顶尖水平

编程能力超GPT-4o:据CSDN 2026年6月横评,DeepSeek V4在Codeforces竞赛编程评分中拿到3206分,达到人类前0.01%水准,超越GPT-4o和Claude 3.5。

开源模型对标闭源巨头:V3.2版本在公开推理测试中达到GPT-5水平,仅略低于谷歌Gemini 3 Pro,证明开源模型与闭源巨头差距急剧缩小。

代码通过率极高:V4在函数生成场景的首次执行通过率达94.3%,两轮内通过率97.1%,开发者实测可将核心系统迭代周期缩短30%。

二、单日处理量揭示实际市场认可度

日消耗8万亿Token:2026年8月初,DeepSeek单日处理量达8万亿Token,相当于约5600万本《三体》三部曲的文字量。

商业化健康运转:尽管有5万亿免费Token,日流水仍约600万元,API定价远低于海外竞品。

登顶全球第一:应用下载量及用户活跃度持续飙升,V4-Flash因性能达到第一梯队但价格仅为十分之一,且开源可本地运行,成为开发者首选。

三、低成本高产出重构行业成本结构

算法优化实现“小力出奇迹”:通过MoE混合专家架构等创新,训练R1模型仅花费560万美元,成本仅为OpenAI o1的几十分之一。

颠覆“更大才更聪明”信条:摩根士丹利指出DeepSeek通过提高数据质量和改进架构,展示了一条高效训练新路径。

国内多行业大规模接入:超100家医院完成本地化部署用于临床决策;三大运营商全面接入,金融机构用于合同质检与智能客服。