news 2026/8/19 23:32:34

DeepSeek 把 Claude Code 的缰绳偷了

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
DeepSeek 把 Claude Code 的缰绳偷了

DeepSeek 把 Claude Code 的缰绳偷了

副标题:5 个月写百万行的护城河,被国产三剑客 72 小时摊到 MIT 协议下。

钩子

8 月 13 日 UTC 11 点 56 分,DeepSeek 在 GitHub 上git push了一个叫deepseek-ai/deepseek-harness的仓库。MIT 协议。一行代码都没写错。

两天后——8 月 15 日——这个仓库已经有了 95,386 个 star,8,826 个 fork。两天,从零到九万五。

同一周,阿里通义把「Claude Code 体验」打成 npm 包@qwen-code/qwen-code推到 Apache 2.0;字节 DeerFlow 2.0 在 70K+ stars 的位置上继续收 LangGraph 重写后的子代理编排。三件事,三种姿势,三套 license——MIT、Apache 2.0、MIT,全是开放的。

讲道理,OpenAI 在 2 月份写《Harness engineering: leveraging Codex in an agent-first world》的时候,那可是 3 个工程师、5 个月、100 万行代码、1500 个 PR 才攒出来的护城河。不到半年,国产三剑客把同一层缰绳摊开给所有人看了。说白了,这次是真的白给。


§1 三剑客 72 小时,把 Harness 摊到 MIT 下

先把三件事按时间线摆出来,别急着下结论。

三剑客的姿势不一样,这是关键。DeepSeek 走「元框架 + 一切皆插件」,Qwen Code 走「终端向 IDE 插件全套体验」,DeerFlow 2.0 走「LangGraph 编排 + 子代理 + 沙箱」。你如果只用一句话区分:DeepSeek 把 Harness 拆成可换零件,Qwen 把 Harness 塞进终端,DeerFlow 把 Harness 当交响乐团排。

再放一张横向对比表,把护城河的关键差异列清楚——这是 8-13 那篇没来得及列完的:

维度DeepSeek Harness (dsh)Claude Code (Anthropic)Qwen CodeDeerFlow 2.0
LicenseMIT闭源 + 商业订阅Apache 2.0MIT
设计哲学一切皆插件(meta-framework)成熟商业产品Claude Code 体验平替LangGraph 编排
主接口Web UI + headless + Python SDKTerminal + VS Code + JetBrains + SlackTerminal + IDE + CI/CD + IM BotPython SDK + 多种 IM 渠道
模型选择DeepSeek / Anthropic / OpenAI / 本地主要 ClaudeOpenAI / Anthropic / Gemini / Qwen / 本地主要 Qwen / 自配
Extensibility极强:每个组件都能换强:Skills / Hooks / MCP / Plugins强:MCP / SubAgents / Auto-Skills强:Skill / SubAgent
成熟度Developer preview(README 警告:会有破坏性变更)已商业化已商业化已商业化

老实说,DeepSeek Harness 这一栏的 Extensibility 是真正的护城河。它不是和 Claude Code 比「谁更好用」,它是和 Claude Code 比「谁更不容易被锁」。Cordis 插件框架把模型、工具、技能、会话、沙箱、存储、循环、调度、UI 全部做成可热插拔的部件——Claude Code 想换底层模型?对不起,得等 Anthropic 自己发版;DeepSeek Harness 想换底层模型?一行配置。


§2 arXiv 2605.18747:Harness 的三大形式化性质

但 Harness 这个词被用烂了。从 2026 年初到现在,LangChain / OpenAI / Anthropic / Martin Fowler / Birgitta Böckeler 五家给的定义都不一样(dev.to 上 kenimo49 那篇综述列得很清楚)。老实说,谁对?

arXiv 2605.18747「Code as Agent Harness」做了一件没人做过的事——把 Harness 形式化成三个可验证的性质,从此别再争定义。我读完第一反应是:早该这么干了。

这张图的重点在右下角那个判定框——首次执行真实业务任务,成功率 ≥ 90%。这是德勤 2026 年企业落地调研给的硬标准,腾讯云开发者那篇文章直接借用了。

讲到这里如果你前两天读过 8-13「Harness 第一线」和 8-14「Harness 在偷笑」应该会有点感觉——OpenAI 那套 AGENTS.md + linter 的硬规则,本质就是给 Harness 灌 Executability;Anthropic 的 progress.txt + Context Reset,本质就是给 Harness 灌 Statefulness。三剑客抄走的不是「Harness」这个名词,是这三个性质。


§3 通信协议:为什么 dsh 的权限模型敢开源

Claude Code 的权限系统是黑盒:哪些命令能跑、哪些目录能写、哪些 API 能调,全在 Anthropic 内部策略里。开源的 Harness 不敢这样。

看下三剑客怎么处理「Agent 向系统请求一次 shell 执行」这条链路:

注意Policy/Approval 是插件,不是写死在二进制里。这就是 DeepSeek Harness 敢开源的核心——整套权限模型是声明式的,任何公司都可以 fork 出来换成自己的合规策略

对比一下:Claude Code 的 Approval Mode 是 YOLO / Plan / Default 三档,藏在 Anthropic 的商业产品里;Qwen Code 同样内置 Approval Mode,但底层规则锁在@qwen-code/qwen-code包里;DeerFlow 2.0 把沙箱做成可替换的 Skill,通过容器 / microVM / WebAssembly 任选。

这意味着什么?意味着国产企业买 DeepSeek Harness,可以直接把 Policy 插件换成自己的「不允许写 /etc、不允许访问海外 API」规则集,不用等开源社区改 issue 也不用等厂商发版。这才是 Harness 进企业的真门槛,也是腾讯云开发者那篇文章说的「Harness 趋同」之外的真正差异化战场。


§4 Harness 不是银弹:腾讯云这盆冷水该不该接

8 月初腾讯云开发者社区那篇「Harness 热退潮后」泼了一盆冷水。我把它核心论点拎出来,再加一层反驳:

腾讯云说:Harness 不是终局,所有工具终将走向趋同。理由是德勤 2026 标准——首次执行真实任务成功率 < 90% 就是失败。Skill 是封装好的 Prompt + 工具调用,靠 Prompt 堆不出企业级可靠性

我同意一半。Skill 确实只是 Prompt + 工具调用,没错。但腾讯云把「Harness 趋同」和「Skill 是天花板」两个论点绑在一起卖,逻辑上不严:

  • Harness 趋同Skill 是天花板。前者是基础设施层的合并,后者是应用层的限制。Anthropic 在 Opus 新版里拆掉自己当年费尽心力搭的控制组件,正是因为模型变强后很多 Skill 成了冗余——但 Executability / Inspectability / Statefulness 三大性质没拆。
  • 首次执行成功率 90%这个标准反过来打 Harness 自己的脸。如果你的 Harness 让 Agent 首次成功率只有 60%,那你需要的不是更多 Skill,是更深的状态外化(Statefulness)和更强的执行验证(Executability)。

怎么说呢,腾讯云的冷水对了一半——Harness 会趋同没错,但趋同的方向不是「都变成一个东西」,是「三大性质全部内置」。三剑客里 DeepSeek Harness 离这个目标最近,因为它的插件机制允许企业直接 fork 一份私有 Policy 写进 CI。


我的判断

赌注 72 小时:DeepSeek Harness v0.1 现在还在 0.1.0-rc.5,README 自己写「会有破坏性变更」。我赌到 2026 年 12 月底之前,要么 DeepSeek Harness 至少稳定到 1.0,要么 Qwen Code 把「插件化」做到和 DeepSeek Harness 同级。DeerFlow 2.0 我反而最不看好——LangGraph + LangChain 重写意味着字节把命运交给 LangChain,而 LangChain 自己都在做 DeepAgents,DeerFlow 2.0 的差异化会被慢慢吃掉。说真的,这事让我有点担心。

时窗 90 天:观察三个信号——DeepSeek Harness 的 npm 下载量能不能破月活 10 万、Qwen Code 的 Skills marketplace 能不能上 GitHub Trending、DeerFlow 2.0 的子代理编排能不能被 LangChain DeepAgents 替代。

反方对冲:如果三个月内 DeepSeek 因为 V4-Pro 涨价把开发者全推到 Anthropic / Claude Code,dsh 可能停在 1.0 之前就没人维护。这是开源最大的风险——模型厂不赚钱就没动力维护框架。Qwen Code 反而更稳,因为阿里靠云卖 Token,Apache 2.0 框架是引流入口不是产品本身。


小结(3 条 Actionable Insight)

  1. 今晚就能做的:打开npx @deepseek-ai/dsh web,跑个 5 分钟的小任务,感受「插件化 Harness」和 Claude Code 的差异;或者npm install -g @qwen-code/qwen-code,在自己项目目录跑qwen
  2. 这周能做的:挑一个企业内部脚本,把 Approval Mode 改成自己的白名单策略(DeepSeek Harness 的 Policy 插件 / Qwen Code 的 Approval 模式),跑通后这就是你公司的私有 Harness。
  3. 看趋势必看的:盯 arXiv 2603.01209「Agents Learn Their Runtime」——这篇论文证明了 Harness 的状态持久化语义必须和模型训练时的语义匹配,80% 缺失变量错误 / 3.5× token 开销就是错配的代价。三大性质不是装饰,是底线。

互动段

下一篇我想拆给你看的点是:DeepSeek Harness 的profile + bundle + patch layer这套机制。它就是把 LangChain 的 LangGraph 配置 + Anthropic 的 Skills marketplace + Vercel 的 bundle 思想三合一。讲真的,看到这块的时候我觉得有点佩服 DeepSeek 团队的抽象能力——把三家的设计哲学缝一块还不漏痕迹。下周给你拆开。

你最近在用哪个 Harness?被坑过哪个 Skill?评论区喊一声,下一篇写它。有想看的具体代码片段也行,留言我接着写。


来源区(≥3 权威 + ≥1 中文一手源)

  1. VentureBeat — DeepSeek Harness launches as open source rival to Claude Code — Carl Franzen 当天深度报道,确认 MIT 协议 + Cordis 元框架 + 95K stars 数据
  2. Qwen Code — Announcing Qwen Code: An AI Coding Agent That Thinks Like a Programmer — 阿里通义实验室官方,Skills / SubAgents / Approval Mode 完整定义
  3. GitHub — bytedance/deer-flow — 字节跳动官方仓库,DeerFlow 2.0 LangGraph 重写版本
  4. 腾讯云开发者 — Harness 热退潮后,Agent 的下一个主战场,不在论文里 — 关键中文一手源,反方对冲素材
  5. cc.bruniaux.com — Code as Agent Harness (arXiv 2605.18747) — arXiv 论文深度解读,三大形式化性质出处
  6. 腾讯新闻 — 2026 年中国 TOP10 AI 代码智能体排行榜 — 新华社瞭望财经 + 快思慢想研究院联合发布,国产地位定论
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/19 23:29:45

编程语言选型指南:从核心维度到应用场景的决策框架

1. 这篇文章真正要解决的问题 你是否曾面对琳琅满目的编程语言感到迷茫&#xff1f;Python、Java、C、Go、JavaScript…… 每一种语言都宣称自己是最好的&#xff0c;每一个社区都充满了热情。新手在入门时&#xff0c;往往被“学哪门语言好”这个问题困扰许久&#xff1b;而有…

作者头像 李华
网站建设 2026/8/19 23:19:09

后端+智谱ai 结合Rxjava,SSE技术向前端推送AI结果

1.创建智谱Ai客户端创建的客户端交给Spring Bean容器管理package com.ldy.yudada.config;import ai.z.openapi.ZhipuAiClient; import lombok.Data; import org.springframework.boot.context.properties.ConfigurationProperties; import org.springframework.context.annotat…

作者头像 李华
网站建设 2026/8/19 23:16:43

Cortex-M汇编优化实战:手搓高性能Biquad滤波器,性能翻倍

1. 项目缘起&#xff1a;为什么要在Cortex-M上用汇编写Biquad滤波器&#xff1f;如果你正在嵌入式音频处理、传感器信号调理或者任何需要实时滤波的领域折腾&#xff0c;大概率听说过IIR滤波器&#xff0c;而Biquad&#xff08;双二阶&#xff09;滤波器则是其中实现最灵活、应…

作者头像 李华
网站建设 2026/8/19 23:13:31

50欧元打造交互式LED桌:ESP8266与WS2812B的DIY实战指南

1. 项目概述&#xff1a;用50欧元打造一张会“说话”的桌子你有没有想过&#xff0c;一张普通的桌子也能变成一个充满互动乐趣的科技中心&#xff1f;今天要聊的这个项目&#xff0c;就是用一个非常有限的预算——50欧元&#xff0c;来打造一张“交互式LED桌”。这听起来像是天…

作者头像 李华
网站建设 2026/8/19 23:07:40

Ubuntu云原生实战:LXD、MicroCloud与Kubernetes的架构选择与实践

Ubuntu云原生实战:LXD、MicroCloud与Kubernetes的架构选择与实践 摘要 云原生技术正在改变企业IT基础设施的构建方式,而Ubuntu作为云原生的首选操作系统,提供了从容器到微云的完整解决方案。本文将深入解析Ubuntu云原生生态中的三大核心组件:LXD容器管理、MicroCloud私有…

作者头像 李华
网站建设 2026/8/19 23:07:11

车灯控制器MCU成本优化:从架构融合到软件精算的工程实践

1. 从“堆料”到“精算”&#xff1a;车灯控制器MCU成本优化的深层逻辑在车灯控制器这个看似不起眼的领域里&#xff0c;成本优化从来不是简单的“砍价”或“换便宜料”。过去几期&#xff0c;我们聊了从架构选型、软件复用&#xff0c;到硬件集成的具体策略。今天这第四篇&…

作者头像 李华