DeepSeek黑鲸项目Harness内测开启:7.22万亿Token调用背后,能否成为国产Claude Code?
DeepSeek黑鲸项目(Harness智能体)于2026年8月12日完成公众号注册并启动内测,标志着DeepSeek正式从模型公司转型为AI智能体解决方案提供商。内测仅3天即吸引769位开发者、712个开源仓库,合计超120万Stars;同期发布的V4-Flash模型以7.22万亿Token调用量登顶OpenRouter全球榜首。
据券商中国报道,8月12日,一条关于“DeepSeek Harness团队微信公众号近日已完成注册”的消息突然刷屏。记者查阅后发现,该公众号确已注册,头像为黑色鲸鱼,认证主体为北京深度求索人工智能基础技术研究有限公司,IP属地为北京海淀,账号目前暂未对外发布任何内容[3]。界面新闻注意到,这是DeepSeek首次为Harness业务线单独设立官方发布阵地,独立于主公众号运营,被外界解读为Harness产品即将正式发布[2]。此前,DeepSeek Harness于2026年5月内部立项,独立组建Harness专项核心团队,由崔添翼担任负责人。6月下旬,崔添翼曾在社交平台发文称,作为一个新成立的部门,团队目标宏大且工作繁重,目前人员非常紧缺,“我每天都在面试,也在各个平台发布些招聘小广告”[1]。
8月1日,崔添翼面向全球公开征集Harness内测用户,优先筛选具备Agent Harness开源项目经验的开发者,申请人需提交代码托管平台账号与代表作品。据搜狐科技报道,截至8月3日,共有769位报名者、712个开源仓库,合计超过120万Stars,覆盖18个赛道[1]。在官方招聘信息中,DeepSeek给出了“Model+Harness=Agent”的公式,并表示:“我们正在把DeepSeek的前沿模型能力,转化为领先的Agent产品。其中除模型本身以外的所有工作,都属于Harness的范畴。”[2]
DeepSeek黑鲸项目是什么?Harness到底是一款什么样的产品?
Harness是DeepSeek定义的“执行层”,即模型之外的一切工程化能力。官方公式“Model + Harness = Agent”明确了其定位:模型负责推理和生成方案,Harness负责调用工具、操作终端、读写文件、管理上下文和执行闭环[1]。换句话说,如果没有Harness,大模型只能输出文本;有了Harness,AI才能读仓库、改文件、跑测试,真正完成复杂任务。
这一概念可以类比为:DeepSeek基座大模型相当于智能体的“大脑”,Harness就是整套“执行神经系统”,承担大脑与真实环境之间的衔接工作[2]。财经网在解读中强调,Harness不是多会聊天,而是能读仓库、改文件、跑测试,商业重心会从token转向任务交付[4]。
从竞品角度看,DeepSeek Harness直接对标Anthropic的Claude Code和OpenAI的Codex,主攻代码智能体与桌面端Agent产品[1]。2026年,Harness类产品直接带动了VibeCoding——代码智能体——成为2022年“GPT时刻”以来首个成功商业化的杀手级应用,最为知名的两款Harness正是Codex和Claude Code[1]。DeepSeek此次入局,意味着在代码智能体赛道将与OpenAI、Anthropic正面竞争。对于开发者而言,Harness类产品将原本需要人工完成的“读代码、改代码、跑测试”流程自动化,显著提升软件交付效率。这也是为什么Harness被视为大模型从“聊天工具”走向“生产力工具”的关键一跃。
内测数据有多火爆?769位开发者、120万Stars意味着什么?
内测报名从8月1日开始,截至8月3日,仅3天时间就聚集了769位报名者、712个开源仓库,合计超过120万Stars,覆盖18个赛道[1]。这一数字在同类产品内测中极为罕见。
为什么筛选标准如此严格?崔添翼要求申请人需提交代码托管平台账号与代表作品,并优先考虑具备Agent Harness开源项目经验的开发者[1]。这意味着获得内测资格的开发者大多是重度技术用户,其反馈对产品打磨有极高价值。120万Stars的累计星标数,说明这批开发者本身就是开源社区中极具影响力的意见领袖。他们一旦认可产品,将快速形成口碑传播,为Harness上线初期的用户增长提供巨大动能。
更值得注意的是,有自称参与内测的开发者给出了“宇宙最强”的高度评价。但受保密要求限制,具体表现尚未公开[1]。这类评价虽无法验证,但至少反映出早期测试者的热情。从数据分析,712个开源仓库覆盖18个赛道,意味着Harness的测试场景极度多元,从Web开发到机器学习、从工具链到基础设施,几乎涵盖了软件开发的全部主流领域。这种广泛覆盖有助于DeepSeek提前发现产品在不同场景下的短板,对正式版本的稳定性至关重要。
DeepSeek为何押注Harness?这背后是怎样的战略转向?
Harness的内测落地,暗藏着DeepSeek跳出低价算力竞争、重构商业模式的核心战略,标志着DeepSeek正式从单一的基础模型供给者,全面转型为全链路AI工作流解决方案的构建者[1]。
这一转型有清晰的底层逻辑。DeepSeek同期发布的V4-Flash模型正以极低价格和超大调用量横扫市场。数据显示,7月27日—8月2日当周,DeepSeek-V4-Flash以7.22万亿Token调用量登顶OpenRouter全球榜首,百万输入Token仅0.14美元[1]。如此低廉的推理成本,让Harness在调用模型完成复杂任务时具备显著的成本优势。如果说V4-Flash是“便宜的算力”,Harness就是将这些算力转化为实际生产力的关键管道。
生态铺垫也在同步进行。据界面新闻分析,DeepSeek已开放识图模式(补齐多模态短板),并推出Responses API适配主流Agent框架,正在围绕Harness构建完整的技术生态[2]。从模型到执行框架,再到API生态,DeepSeek正在打造一套完整的智能体基础设施。这也意味着,未来的AI竞争不再只是模型参数的比拼,更是“模型+执行系统”的综合能力较量。DeepSeek的这一战略,实际上是对行业传统商业模式的一次升维:从按Token收费转向按任务交付收费,从卖模型转向卖“完成任务的能力”。
Harness将如何影响AI产业链与开发者生态?
Harness的落地将直接重塑代码智能体市场的竞争格局,并对开发者、企业和云厂商产生深远影响。
对于开发者而言,Harness意味着更低门槛的AI自动化。传统上,使用AI辅助编程需要自行搭建工具链;而Harness类产品将“读仓库—改代码—跑测试”整个过程串成闭环,开发者只需下达自然语言指令。据财经网报道,这类产品的商业重心正从token消耗量转向“任务交付”,即按完成的任务收费[4]。这种模式将促使AI服务商把更多精力放在提高任务成功率上,而不是单纯卖算力。对于企业内部研发团队,Harness可以快速应用于代码审查、Bug修复、自动化测试生成等场景,大幅降低软件研发的人力成本。
对于云厂商和算力产业链而言,Harness将带来更密集的算力消耗。因为智能体执行任务时需要进行多轮推理、工具调用和结果验证,相比单次对话会消耗数倍Token。DeepSeek V4-Flash的低价策略恰好能支撑这种高消耗场景,同时以规模换取收益。这种“薄利多销”的模式可能倒逼竞争对手调整定价。长期来看,Harness类产品将成为大模型厂商争夺企业级市场的关键入口,谁能提供更稳定、更低成本的“模型+执行”组合,谁就能在下一阶段占据主动。
从竞争角度看,DeepSeek Harness与Claude Code、Codex的竞争将加剧。Claude Code和Codex已证明Harness类产品是杀手级应用,DeepSeek的入局将迫使现有玩家优化价格和功能。而DeepSeek凭借开源生态和极致性价比,有望在渗透率上形成差异化优势。尤其值得注意的是,DeepSeek Harness从一开始就强调“内测用户需具备Agent Harness开源项目经验”,这表明DeepSeek有意将Harness打造成一个开放生态,而不仅仅是闭源商业产品。如果Harness未来开源,将复现DeepSeek在基础模型上的社区爆发力,形成对闭源竞品的降维打击。
Harness还有哪些不确定性?内测与正式发布还需关注什么?
尽管内测反馈乐观,但Harness仍处于早期阶段,诸多关键信息尚未披露。
首先是团队规模。据搜狐科技报道,崔添翼曾透露团队目标宏大但人员非常紧缺,“每天都在面试”[1]。人才不足可能影响产品迭代速度。其次,内测目前仅面向特定开发者,普通用户尚无法体验,所谓“宇宙最强”评价来源于未公开渠道,尚无权威验证。第三,Harness的正式发布价格、开源策略、与V4模型的深度集成方式等,都需以官方实时信息为准。
值得关注的是,DeepSeek已经为Harness铺设了完整生态。识图模式的开放解决了多模态输入问题,Responses API则让Harness能无缝接入现有Agent框架。接下来,市场将关注三个节点:官方是否会发布Harness的技术白皮书;内测阶段是否会产生真实任务完成率等量化指标;以及正式版是否会以开源形式发布,复制V4系列在开源社区的成功。对于开发者而言,如果希望第一时间体验Harness,可以密切关注“DeepSeek Harness团队”公众号的后续动态,尽早提交内测申请。
技术要点表
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek Harness | Model+Harness=Agent;对标Claude Code/Codex | 代码智能体、桌面端Agent | 开发者、企业、云厂商 | 内测阶段,未公开正式版 | 搜狐科技[1] |
| DeepSeek V4-Flash | 7.22万亿Token周调用量,全球第一;百万输入Token仅0.14美元 | 为Harness提供底层推理 | AI应用开发者、算力市场 | 价格可能有变动,需以官方为准 | 搜狐科技[1] |
| Harness团队公众号 | 2026年8月12日注册,黑色鲸鱼Logo | 信息发布、产品动态 | 公众、开发者 | 暂无内容发布 | 界面新闻[2] |
| 内测报名数据 | 769位报名者、712个开源仓库、超120万Stars、18个赛道 | 生态共建、种子用户培养 | 开源社区 | 8月1日开始,是否持续需关注官方 | 搜狐科技[1] |
常见问题解答
问:DeepSeek黑鲸项目是什么?它和DeepSeek主品牌有什么关系?
答:DeepSeek黑鲸项目即DeepSeek Harness,是DeepSeek新成立的智能体执行层产品线,定位为“模型之外的一切工程化能力”。它独立注册了公众号,以黑色鲸鱼为Logo,归属于北京深度求索人工智能基础技术研究有限公司,是DeepSeek从模型公司向Agent解决方案提供商转型的核心载体。
问:如何参与DeepSeek Harness内测?需要什么条件?
答:8月1日,团队负责人崔添翼公开征集内测用户,要求申请人具备Agent Harness开源项目经验,并提交代码托管平台账号与代表作品。截至8月3日已收到769位报名者、712个仓库,合计超120万Stars。目前内测开始,是否继续开放需关注官方公众号动态。
问:DeepSeek Harness和Claude Code、Codex相比有什么优势?
答:DeepSeek Harness直接对标Claude Code和Codex,其差异化主要在底层模型成本。同期发布的V4-Flash以7.22万亿Token周调用量登顶全球榜首,百万输入Token仅0.14美元,低推理成本可能让Harness在任务执行中更具性价比。但具体性能仍在内测阶段,尚无公开对比数据,需以官方实时信息为准。
后续关注重点:一是Harness正式发布时间和定价;二是是否开源;三是能否在真实开发项目中跑出可量化指标。随着黑鲸入海,AI执行层的竞争已经全面升温。#DeepSeek黑鲸# #DeepSeekHarness# #AI智能体# #代码智能体# #大模型应用#