新浪AI前沿速递
昨天 06:47来自 科技看点

DeepSeek V4 Flash的8万亿Token统计口径是什么?

最近 DeepSeek V4 Flash 因为一天消耗8万亿Token冲上热搜,很多人以为是在“烧钱”,其实这个数字指的是它在海外单一编程平台OpenCode上一天处理的文字量,换算下来大概相当于5600万本《三体》的体量。

一、8万亿Token的统计口径不是全网总消耗

数据发布方与平台:这个数据由海外开发者开源项目团队OpenCode于2026年8月3日公布,指的是DeepSeek V4 Flash在其平台上的单日调用量,并非DeepSeek全球全渠道的总用量。

Token构成:8万亿Token中,约有5万亿来自开发者的免费试用额度消耗,3万亿为开发者通过OpenCode付费商用调用。

费用换算:按DeepSeek官方定价(输入约1元/百万Token、输出约2元/百万Token),3万亿付费Token折算下来日流水约600万元人民币,单价极低。

二、单模型单日消耗碾压全行业日均水平

横向对比:聚合了400多款模型的平台OpenRouter,全平台日均处理量约为6.6万亿Token。DeepSeek仅一款模型、在OpenCode这一个入口的单日消耗量,就已超过OpenRouter全平台的日均水平。

概念具象化:8万亿Token相当于约5600万本《三体》三部曲的文字量,或4万部完整电影剧本的体量。

市场验证:OpenRouter最新周榜显示,DeepSeek V4 Flash以7.22万亿Token的周调用量位居全球第一,且全球调用量前五名全部为中国大模型。

三、极致性价比是爆发背后的核心驱动力

技术架构优势:V4 Flash采用MoE(混合专家)架构,总参数284B但单次推理仅激活13B参数,大幅降低了计算负载。

缓存折扣策略:提供高达98%的缓存命中折扣(行业普遍为90%),命中缓存的输入价格仅0.2元/百万Token,为标价的2%。

行业连锁反应:该数据直接倒逼OpenAI紧急将GPT-5.6 Luna降价80%,但即便降价后,DeepSeek单任务成本仍比Luna低约60%。