购机指南局
2026-08-13 09:13来自 科技看点

DeepSeek黑鲸项目内测开启,V4 Pro正式版发布,百万tokens最低0.025元,怎么选?

  DeepSeek黑鲸项目(即DeepSeek Harness)已于2026年8月1日启动全球内测,截至8月13日仍在进行中。8月13日当天,DeepSeek V4 Pro正式版同步上线,模型版本更新为DeepSeek-V4-Pro-0813,API百万tokens输入缓存命中价低至0.025元。参与内测的开发者给出了“宇宙最强”的高度评价,但受保密协议限制,具体能力尚未对外披露。

  DeepSeek黑鲸项目是DeepSeek官方定义的“模型之外的一切工程化能力”系统,官方公式为“Model+Harness=Agent”。它于2026年5月内部立项,由崔添翼担任专项团队负责人。8月1日,团队面向全球公开征集内测用户,优先筛选具备Agent Harness开源项目经验的开发者,申请人需提交代码托管平台账号与代表作品[1]。8月12日,“DeepSeek Harness团队”微信公众号完成注册,头像为黑色鲸鱼,认证主体为北京深度求索公司[3]。业内普遍认为,这是DeepSeek从基础模型供给者向全链路AI工作流解决方案构建者转型的关键一步[1]

  DeepSeek黑鲸项目是什么?和V4 Pro有什么关系?

  先说结论:DeepSeek黑鲸项目就是DeepSeek Harness的中文昵称,它不是一个传统意义上的大模型,而是让模型真正“跑起来”的工程化系统。官方招聘信息给出的定义是:“我们正在把DeepSeek的前沿模型能力,转化为领先的Agent产品。其中除模型本身以外的所有工作,都属于Harness的范畴。”[1]

  如果用比喻来理解,DeepSeek V4 Pro这类大模型是“大脑”,负责计算、推理与认知;而DeepSeek黑鲸项目则是“小脑+手脚+神经系统”,负责工具调用、代码执行、环境交互、任务规划等模型之外的所有工程化能力。两者组合起来,才能构成一个完整的AI Agent。

  DeepSeek V4 Pro正式版在8月13日的发布,被不少分析视为黑鲸项目的最佳搭档。模型版本更新为DeepSeek-V4-Pro-0813,支持1M上下文长度,最大输出384K Token,同时支持思考模式和非思考模式[4]。这为Harness的Agent能力提供了更强的底层模型支撑。换句话说,V4 Pro解决“想得懂”的问题,Harness解决“做得成”的问题。

  “黑鲸”这个昵称也颇有意思。8月12日注册的“DeepSeek Harness团队”微信公众号,头像是一条黑色鲸鱼,与DeepSeek官方账号的蓝色系形成鲜明反差[3]。因此媒体和网友将其称为“DeepSeek黑鲸”,进而演化为“黑鲸项目”。公众号的注册,标志着Harness业务开始以独立品牌形象出现在公众面前,但这并不等于产品已经向公众开放。

  DeepSeek黑鲸项目内测进展如何?何时向公众开放?

  先说结论:截至2026年8月13日,DeepSeek黑鲸项目仍处于早期内测阶段,官方未公布任何向公众全面开放的具体时间表。所有“即将开放”的说法均为行业推测,需以官方信息为准。

  从时间线来看,DeepSeek Harness于2026年5月内部立项,独立组建专项核心团队,由崔添翼负责。6月下旬,崔添翼在社交平台发文称团队目标宏大、人员紧缺,“我每天都在面试,也在各个平台发布些招聘小广告”[1]。8月1日,团队面向全球公开征集内测用户,优先筛选具备Agent Harness开源项目经验的开发者。8月12日,“DeepSeek Harness团队”微信公众号完成注册,认证主体为北京深度求索公司[3]。这一连串动作让“DeepSeek黑鲸”的话题热度迅速攀升。

  内测反馈方面,网络上号称参与内测的网友给出了“内测2天之后,愿意称DeepSeek Harness为‘宇宙最强’”的评价[2]。但必须说明的是,该评价属于个人观点,且受保密协议限制,没有可验证的测试数据或截图流出。目前没有任何第三方机构发布过关于Harness的基准测试报告。

  对于公众开放时间,业内分析认为,DeepSeek黑鲸项目大概率会与V4 Pro正式版搭档亮相。如今V4 Pro正式版已于8月13日发布,而Harness仍未全面开放,说明其打磨周期可能长于预期。官方始终没有对Harness的开放时间做出承诺或预告,因此用户不宜盲目等待,应关注DeepSeek官方渠道的后续公告。

  值得注意的是,公众号注册本身并不意味着开放。参考同类产品经验,一个独立产品公众号的注册,往往是为了后续发布公告、招募内测和构建社区做准备。东方财富网等媒体在报道时也强调,该公众号的注册“标志Harness业务正式面向大众亮相”,但“并非公众开放使用的信号”[3]。对于普通用户来说,现阶段最正确的姿势是保持关注,而不是急于入手。

  DeepSeek黑鲸项目性能到底多强?“宇宙最强”说法靠谱吗?

  先说结论:目前没有公开的Harness独立评测数据,“宇宙最强”是参与内测网友的个人说法,未被官方证实,也没有可复现的测试依据。与其轻信“宇宙最强”,不如关注与其搭档的DeepSeek V4 Pro正式版已经公布的性能数据。

  根据公开信息,DeepSeek V4 Pro正式版在多个Agent相关基准上实现大幅跃升:Terminal-Bench 2.1得分从72.1提升至87.9,CyberGym从52.7提升至83.3,DeepSWE从12.8%提升至62.7%,AutomationBench达到31.8%[4]。这些数据覆盖终端操作、网络安全、软件工程和自动化工作流,恰好是Harness可能涉及的典型场景。

  此外,DeepSeek V4-Flash模型在7月27日至8月2日当周,以7.22万亿Token调用量登顶OpenRouter全球榜首[2]。这说明DeepSeek模型在开发者调用端已经积累了庞大的用户基础,而黑鲸项目正是将这种调用量转化为Agent产品商业化的关键环节。

  从行业背景看,2026年,Harness概念带动的“代码智能体”(VibeCoding)已成为2022年“GPT时刻”以来首个成功商业化的杀手级应用,最知名的两款Harness产品是OpenAI的Codex和Anthropic的Claude Code[1]。DeepSeek黑鲸项目的目标,就是在这个赛道上推出更具性价比和工程化能力的中国方案。因此,它的性能评价不能只看“宇宙最强”这种情绪化表述,而要看它在真实开发任务中的通过率、延迟、成本与稳定性。

  此外,内测阶段的评价往往带有“早期采用者”的滤镜。参与内测的开发者通常对技术前沿有较高热情,且DeepSeek官方在筛选时优先选择有Agent Harness开源项目经验的人群,这一群体本身更容易给出积极反馈。所以“宇宙最强”更适合被理解为“内测用户的主观惊叹”,而非可横向比较的客观结论。

  DeepSeek黑鲸项目的价格和配置如何?现在值得入手吗?

  先说结论:DeepSeek黑鲸项目本身暂无公开定价,内测资格仅向特定开发者开放;但与之配套的DeepSeek V4 Pro正式版API价格已经公布,可以视为Harness落地后的基础成本参考。

  V4 Pro正式版的价格为:百万tokens输入(缓存命中)0.025元,百万tokens输入(缓存未命中)3元,百万tokens输出6元,与预览版一致。官方备注显示“近期将大幅涨价”[4]。这意味着现阶段可能是体验V4 Pro的窗口期。配置方面,V4 Pro支持1M上下文长度,最大输出384K Token,同时支持思考模式与非思考模式,默认开启思考模式,并覆盖了主流Agent开发需求[4]

  如果把V4 Pro看作Harness的“发动机”,那么它的价格直接决定了Agent产品的边际成本。0.025元/百万tokens的缓存命中价,在业内已经低到接近“地板价”。相比之下,OpenAI和Anthropic的同级别模型收费往往高出数倍至数十倍。DeepSeek选择在V4 Pro发布时维持低价,同时又预告“大幅涨价”,很可能是为了配合Harness商业化前期的规模扩张。

  对于“现在值得入手吗”,需要分人群回答。如果你是具备Agent Harness开源项目经验的开发者,可以尝试在内测渠道提交代码托管平台账号与代表作品,争取提前体验黑鲸项目。如果你是普通用户或中小团队,建议先接入V4 Pro API,评估其在真实任务中的表现,同时留意V4 Pro的涨价幅度。如果涨价幅度可控,V4 Pro依然是性价比很高的Agent基座模型;如果大幅上涨,则需要重新计算成本。

  需要特别提醒的是,DeepSeek Harness的内测申请有明确门槛,并非人人可测。网上流传的“宇宙最强”评价缺乏可验证信息,消费者和开发者都不应将其作为决策依据。一切以官方披露为准。

  DeepSeek黑鲸项目适合谁?开发者怎么选?

  先说结论:DeepSeek黑鲸项目适合AI Agent开发者、代码智能体团队、企业级自动化方案集成商,以及希望从“调模型”升级到“造Agent”的技术人员。普通消费者暂时与它无关。

  为了帮助开发者快速理解DeepSeek黑鲸项目的定位,我们整理了当前主流的代码智能体产品对比(基于公开报道整理,具体以官方最新信息为准):

产品/型号价格/定位核心配置优势短板适合谁注意点
DeepSeek Harness(黑鲸)内测中,暂无公开定价;定位为全链路AI Agent工程化基座Model+Harness=Agent;与V4 Pro搭配;V4 Pro支持1M上下文、384K输出DeepSeek自研模型生态;内测评价极高;有望延续低价策略未公开;仅限开发者内测;正式开放时间未知AI Agent开发者、代码智能体创业团队需提交代码仓库账号申请内测;实际表现待官方披露
OpenAI Codex商业产品,需订阅或API付费;定位为代码智能体基于OpenAI模型的编程Agent,集成IDE和CLI生态成熟、用户基数大、模型能力强价格较高;闭源;对上下文和成本敏感专业开发者、企业研发团队需关注按量计费成本
Anthropic Claude Code商业产品,需API付费;定位为代码智能体基于Claude模型的编程Agent,注重长上下文和安全性长上下文能力强;安全对齐好;适合复杂任务价格高;可用地区有限;受API限流影响大型企业、追求稳定性的开发者需了解Claude API价格

  从表格可以看出,DeepSeek黑鲸项目的最大变量在于“Model+Harness”的深度捆绑。DeepSeek既有自研模型,又通过Harness补齐工程化能力,这种软硬一体的打法在成本控制和任务适配上有天然优势。而OpenAI Codex和Anthropic Claude Code已经形成成熟生态,但整体价格更高,且闭源体系下的可定制性受限。

  对于开发者来说,选择哪款产品,取决于你的实际场景:如果你需要低成本、高可定制、与DeepSeek模型深度协同,可以等待黑鲸项目开放;如果你需要开箱即用的成熟方案,Codex和Claude Code依然是稳妥选择。值得注意的是,DeepSeek官方已将“Model+Harness=Agent”写入招聘信息,说明这一定位是公司的长期战略,而非临时项目[1]

  优缺点与决策建议

  • DeepSeek黑鲸项目的潜在优点:DeepSeek模型能力支撑,工程化与模型深度耦合,价格可能更具竞争力,且面向开发者生态开放程度较高。
  • DeepSeek黑鲸项目的潜在短板:尚在内测,稳定性未经验证;无公开文档;生态需要从零积累;正式版发布时间不确定。
  • 购买决策建议:如果你是技术尝鲜者,可以申请内测;如果你是商业用户,建议等待正式版和价格表;如果你只是普通用户,暂时无需关注。

  后续关注哪些信号?

  • DeepSeek官方是否公布Harness公众开放时间和详细技术文档;
  • V4 Pro正式版涨价的幅度与生效日期;
  • DeepSeek Harness是否开源,以及是否支持第三方模型接入;
  • 独立第三方机构对Harness的评测数据。

  关于DeepSeek黑鲸项目,你可能还想问

  Q1:DeepSeek黑鲸项目什么时候向公众开放?

  据公开报道,DeepSeek黑鲸项目(DeepSeek Harness)目前仍处于早期内测阶段,官方尚未公布公众开放时间。行业推测其可能随DeepSeek V4 Pro正式版(已于8月13日发布)后逐步开放,但尚无官方确认,需以官方实时信息为准。

  Q2:DeepSeek黑鲸项目价格多少?

  DeepSeek黑鲸项目本身暂无公开定价。其配套的DeepSeek V4 Pro正式版API价格为:百万tokens输入缓存命中0.025元、缓存未命中3元、输出6元,官方备注近期将大幅涨价。

  Q3:普通人能用DeepSeek黑鲸吗?

  目前不能。内测仅面向具备Agent Harness开源项目经验的开发者,需提交代码托管平台账号与代表作品。普通用户建议关注DeepSeek官方渠道,等待后续开放计划。

  DeepSeek黑鲸项目的内测,是2026年AI Agent赛道最具想象力的事件之一。它可能重新定义“模型+工程化”的商业模式,也可能成为DeepSeek摆脱价格战、构建全新盈利曲线的关键跳板。但在官方披露更多真实数据之前,我们不妨保持理性观望,把“宇宙最强”当作一个美好的期待,而不是结论。

  #DeepSeek黑鲸# #DeepSeek Harness# #DeepSeek V4 Pro# #AI Agent# #代码智能体#