(文 / 陈济深 编辑 / 吕栋)
8 月 13 日,DeepSeek 上线两项重大更新。在模型层面,DeepSeek V4 Pro 正式版全量上线,而在智能体框架层面,DeepSeek Harness v0.1 以 MIT 协议开放源码。此前主要通过模型、应用和 API 进入开发者工作流的 DeepSeek,由此拥有了自己维护的通用 Agent。
有行业人士对观察者网表示:DeepSeek Harness 是中国公司第一次在模型 + 工程外壳这个层面,有了和 Anthropic 正面对抗的完整闭环能力。
截至 8 月 14 日下午,DeepSeek Harness 官方 GitHub 页面显示 80.3k Star(点赞)和约 7000 个 Fork(复制),仅用 24 小时就超越了马斯克 xAI 在 2024 年 3 月 18 日上线的 Grok-1 累计至今的 5.2 万 Star。仓库公开约 21 小时,围绕 dsh-plugin 主题的仓库已经超过 1300 个。
DeepSeek 表示,当前版本标为开发者预览版,产品仍在打磨期间,后续可能出现不兼容改动。

DeepSeek Harness 官方 GitHub 仓库。截至 2026 年 8 月 14 日 16 时 39 分,页面显示 80.3k Star。
对国内开发者来说,这次发布最实在的变化是:AI 操作电脑的那套 " 手脚 ",终于有了中国人自己维护的开源版本。
大模型本身只是个 " 大脑 ",它能思考、能写代码,但没法直接碰你电脑里的文件,也没法自己打开终端跑命令。中间必须有一层 " 手脚 " 帮它执行 —— 决定它能读哪些文件夹、能不能删东西、调用什么工具、对话记录存在哪。这层东西,就是行业里说的 "Harness(智能体框架)" 。
过去智能体 " 手脚 " 基本由海外团队说了算,比如 Claude Code、GitHub Copilot 等客户端。
DeepSeek 今年 4 月发布 V4 预览版时,已经把模型本身、网页端、API 和开放权重都铺好了,但唯独缺这层 " 手脚 "。开发者想用 DeepSeek 的模型改本地代码、跑测试,还得另外搭一套第三方 Agent 工具。本次 DeepSeek Harness 补上的就是这块短板,把 " 模型 + 执行框架 " 整条链路收进了 DeepSeek 自己的产品体系里。
值得注意的是,DeepSeek 并非首个发布相关智能体框架的中国企业,阿里 Qwen Code、字节跳动 DeerFlow 2.0 等项目已经陆续开源发布。DeepSeek Harness 的发布也意味着厂商之间的竞争也不再只比谁的模型更聪明、API 更便宜,而是开始抢开发者的桌面入口、工具接口和对话管理权。
相比模型调用只是这个入口里流过的一条数据。谁掌握了框架,谁就掌握了 AI 在你电脑上的行为规则。
作为开源先锋,DeepSeek Harness 没有把自己绑死在 DeepSeek 一家模型上。目前它目前内置了 38 条模型供应商的接入路由,其中 DeepSeek、蚂蚁、月之暗面、MiniMax、千问、小米、智谱等国产厂商占了 15 条,大约四成。国内开发者装好框架后,可以在菜单里直接选多家国产模型用;Anthropic、OpenAI、Google、Bedrock、Groq、Mistral 等海外服务也都在列表里。
这种设计给企业留了灵活替换的余地。Agent 框架可以部署在公司本地,模型请求则可以指向国内服务商,或者企业自己搭的兼容接口。代码会不会被发到外网,最终取决于你选了哪家模型、装了哪些工具和插件。开源直接降低了企业对单一海外客户端和账号体系的依赖。
值得注意的是,DeepSeek 专门给 Anthropic 的 Claude Code 和 OpenAI 的 Codex 写了可选的 " 子代理 " 插件。用户在本机装好、完成认证后,可以让 Harness 把任务转包给这两个竞品去做。
这个选择很能说明 DeepSeek 的思路:框架向全球所有模型和工具开放,但国产模型拿到了第一批最显眼的位置。
这次发布赶上了国内企业重新检查海外 AI 编程工具风险的时间窗口。
6 月 30 日,有网友通过公开的逆向分析发现,4 月 2 日发布的 Claude Code 2.1.91 版本开始包含一套未在更新日志披露的分类机制。用户设置非官方 ANTHROPIC_BASE_URL 后,程序会检查端点域名和中国时区,再把判断结果编码进发送给模型的系统提示日期字符串。
尽管现有材料没有证明这套机制上传完整代理地址、设备指纹或代码仓库。但是这种偷偷 " 查户口 " 的行为依然激起了中外开发者的群情激愤。Claude Code 团队工程师随后称,这项实验用于识别未授权转售和防范模型蒸馏,相关逻辑已在 7 月 1 日发布的 2.1.198 版本中移除。
7 月 8 日,工业和信息化部网络安全威胁和漏洞信息共享平台发布风险提示,称相关版本 " 存在安全后门隐患,危害严重 "。
观察者网此前报道,阿里内部已将 Claude Code 列入高风险软件名单,并推荐员工在办公环境转用 Qoder。
这件事之所以和 Harness 直接相关,是因为 Agent 框架天生就能接触到你的代码、终端命令和本地文件。企业用这类工具,最关心的就是:它到底读了什么?又把什么发出去了?
Claude Code 的争议,把 " 源码可审计 " 这件事提升到了企业 AI 安全的重要一环。DeepSeek 采用的 MIT 开源协议允许国内公司把代码下载下来、自己留存版本、逐行检查源码、修改默认配置,充分满足了个人和企业的安全需求。
不过,开源不等于零风险。DeepSeek Harness 的安装依赖 Node 和 npm 生态,运行还需要算力、模型服务和第三方插件。官方说明显示,默认的写入策略主要限制了能写哪些目录,但对读取文件、联网、进程可见性的约束比较松;" 创造模式 " 甚至可以直接执行模型生成的 JavaScript 代码,第三方插件也被默认为可信代码。
DeepSeek 在正式发布 Harness 之前,就已经把它用进了自己的模型评测流程。公司 7 月 31 日的更新日志里写明,V4 Flash 的公开代码 Agent 评测,用的就是当时还没发布的 Harness 极简模式。
随着 8 月 13 日同步发布的 V4 Pro 正式版,DeepSeek 继续把 Agent 能力放在核心位置。
DeepSeek 公布的跑分显示,V4 Pro 在 Terminal Bench 2.1 上拿到 87.9 分,在 NL2Repo 和 DeepSWE 上分别拿到 61.5 和 62.7 分。新版本支持 OpenAI Responses API 格式,还提供了一键配置 Codex 的脚本。
Harness 的设计理念叫 " 一切皆插件 ":模型、工具、对话记录、存储方式都可以替换,连沙箱和界面都是独立插件,由名为 Cordis 的内核负责把所有插件加载到一起、协同工作。目前的版本提供了四种预设模式:标准模式用于日常编程,PTC 模式用于程序化工具调用,极简模式用于模型评测,创造模式用于插件调试。
DeepSeek Harness 的热度持续飙升也引来了网友们纷纷参与玩梗,开源不到一天,有人做了个 Claude Code 风格的全屏终端,顶栏趴着一条像素鲸鱼;有人给纯文本模型补上了图像问答、OCR 和界面识别能力;还有人写了个中文网页风格的广告插件,上面写着 " 是兄弟就来蹬我 ",配套做了一张 " 贪玩蓝鲸 " 的虚假页游海报,发布后很快拿到了两百多点赞。


登录后才可以发布评论哦
打开小程序可以发布评论哦