数码迭代留影
DeepSeek V4 Pro的上下文窗口有多大?
一、百万级上下文:能一次消化整部《三体》
规模参数:V4 Pro的总参数量为1.6万亿,激活参数490亿,全系标配百万token超长上下文。
实际意义:可一次性处理整部《三体》三部曲或《百年孤独》体量的文本,无需分段投喂,彻底解决长文档处理、代码审计、企业知识库等场景的痛点。
前后对比:相比上一代V3系列的128K上下文,新模型的上下文长度提升了近8倍。
二、能力跃升:Agent性能全面接近顶级闭源模型
整体定位:官方将V4 Pro定位为“完全体”,Agent能力相比预览版近乎翻倍式提升,多项测试逼近甚至反超Anthropic的Claude Fable 5。
关键基准:Terminal Bench 2.1得分从72.1跃升至87.9,紧贴榜首;DeepSWE从12.8飙升至62.7,与Opus 4.8持平;Cybergym从52.7升至83.3,超越Fable 5。
技术支撑:采用DSA2稀疏注意力机制与混合注意力架构,百万token下单token推理计算量降至前代的27%,显存占用压缩至10%。

三、定价与接入:继续“价格屠夫”路线
API价格:输入3元/百万token(缓存命中仅0.025元),输出6元/百万token,约为V4 Flash的3倍,但仅为海外同类模型的几十分之一。
功能支持:原生支持思考与非思考双模式、Tool Calls、Responses API,兼容OpenAI与Anthropic接口,可直接导入Codex使用。
并发限制:API并发限制为500,官方已预告近期将整体涨价且“涨幅较大”。
