星际广角镜
2026-08-14 15:35来自 科技看点

DeepSeek模型有哪些特点?

  DeepSeek V4 Pro正式版在深夜静默上线后不到24小时就撤回了官网公告,这一波"回滚"操作让开发者们议论纷纷,但模型本身的技术底牌和定价策略其实更加值得细看——在跑分与实测体感的落差背后,V4 Pro在参数量、上下文窗口、Agent能力和性价比上都交出了一份硬核的答卷。

  一、技术底座:万亿参数与超长上下文

  MoE架构与参数量:V4 Pro采用混合专家(MoE)架构,总参数达1.6万亿,每次推理仅激活约490亿参数,兼顾了性能与推理效率。

  超长上下文窗口:支持100万token的上下文输入,单次最大输出可达38.4万token,能够处理长文档、大型代码库等高复杂度任务。

  双模式支持:同时支持"思考"(reasoning)与"非思考"模式,可通过参数调节思考深度,适应不同场景需求。

  

  二、性能表现:Agent能力逼近第一梯队

  智能体基准跃升:相比预览版,V4 Pro正式版在Agent测试中大幅提升——DeepSWE软件工程基准从12.8飙升至62.7,接近Anthropic Fable 5的水平;TerminalBench达87.9,HLE带工具测试达60.0。

  竞技场排名:根据Artificial Analysis的评测,V4 Pro在全球大模型竞技场中排名第9,与GLM-5.2相当。

  跑分与体感落差:部分开发者实测反馈,长程任务和复杂代码场景的体验与官方跑分存在差异,存在早停、逻辑断层等现象,这也被认为是撤公告的潜在原因之一。

  

  三、定价与生态:明明低价,却准备大幅涨价

  当前价格极具竞争力:目前V4 Pro输入为3元/百万token,输出6元/百万token,仅为V4 Flash的3倍,相比Fable 5等海外模型的数十美元定价有巨大优势。

  峰谷定价机制:官方已推出峰谷定价方案,闲时价格为高峰时段的一半,鼓励开发者错峰使用,降低调用成本。

  官方已预告涨价:模型价格页面明确写明"计划在不久的将来大幅上调API价格",并已公布从8月17日起执行新价格。

  生态兼容性:原生支持Responses API、Anthropic API格式和Codex接入,开发者可以零迁移成本将原Claude技术栈切换到DeepSeek。