DeepSeek开源智能体,刚Claude Code

8月13日,DeepSeek 干了一件让整个 AI 编程圈炸锅的事:把自己那套 AI 编程智能体框架 Harness 直接开源了,MIT 协议,谁都能拿去改、拿去商用。

一个"框架"火成这样,挺少见。仓库刚公开,当天 Star 就冲到快 3 万;几天功夫已经破了 4 万。我盯着这个数字看了半天,觉得它说明了一件事:开发者被闭源智能体憋了太久的委屈,终于有人接住了。

想想也合理。过去两年,Claude Code、Codex 这些产品把"智能体该长什么样"定死了,你想加个功能、改个逻辑,要么等官方,要么 fork 一整套自己养。中小团队根本养不起。DeepSeek 这回把地基开源,等于把"定义权"从产品方手里抢回来了一截。

它到底是什么

先说清楚 Harness 是个啥。你用 Claude Code、用 Codex,本质上是在用一个"壳":它负责调模型、跑命令、读写文件、做审批、隔离沙箱。模型是大脑,这个壳就是身体。DeepSeek 之前只有大脑(V4 系列模型),身体一直是别人的。

这次开源的 DeepSeek Harness,命令行叫 dsh,就是它自己造的身体。

装起来简单到离谱:一条命令 npx @deepseek-ai/dsh web,浏览器开 127.0.0.1:3080,一个完整的智能体界面就起来了。整个项目用 TypeScript 写,底层挂着一个叫 Cordis 的老框架——这东西 2022 年就开源了,一直没火,星数不到 2000,结果这回被 DeepSeek 拎出来当地基,一夜成了本周最红的仓库。有点像那个闷头写了四年没人看的底层库,突然被大厂选中成了承重墙。

最狠的一刀:它能挂上 Claude

真正让开发者兴奋的,是它那句口号:一切皆插件。

别的框架,模型怎么调、工具怎么注册、会话怎么记、Agent 怎么循环,全都焊死在核心里。你想改一个,只能 fork 整个项目,然后永远跟不上上游更新。DeepSeek 把这套逻辑拆了:模型适配器、工具注册表、会话日志、Agent Loop、沙箱策略、审批策略、UI,全都是插件,挂在同一个共享上下文上。你想换哪个,写个新插件挂上去就行,不用碰源码,甚至运行时就能热插拔。

我有个做基础架构的朋友看完提交记录,原话是:"这是 Agent 领域的 Linux 内核时刻。" 倒不是吹,是它真的把可替换做到了极致——连 Agent Loop 本身都能换。以前你改个东西得 fork,现在你改个东西只要挂插件。

但最狠的一刀在别处。它的适配器列表里,不光有 DeepSeek 自己的模型,还内置了 Anthropic 和 OpenAI 的一等公民支持。意思是,你可以用这个开源壳,直接把 Claude 或者 GPT 接进来跑。Claude Code 那个闭源的壳你用不惯、还贵,现在有人给你一个开源的、能随便改的壳,你的 Claude 往里一塞照样用。这等于用开源的方式,把闭源产品的护城河给填平了。顺带说一句,Claude Code 到现在源码都没公开,GitHub 上那个仓库只是文档和追踪页,连许可证都没有。DeepSeek 这回是把真源码扔出来的。

还有个细节很硬:它规定"模型看到的,必须等于日志里记下来的"。任何要发给模型的内容,必须能从会话日志重建,否则直接报错。这一条把可审计、可复现钉死了。企业最怕的就是智能体半夜偷偷干了啥说不清,这套设计刚好戳在痛点上。

举个具体的例子,能看出这架构有多松。它的文件系统和子进程共享同一个执行世界,你把对应的 Provider 指向一个远程沙箱,Bash、终端、LSP 全部自动跟着迁过去,一行工具代码都不用改。官方管这叫"能力接缝":换一个底层 Provider,上层所有消费者自动适配。对要在内网、在隔离环境里跑智能体的公司,这点比多几个花哨功能实在。

造身体的团队,两个月交卷

这事儿不是拍脑门。DeepSeek 5月就组了 Agent Harness 团队,挂帅的是崔添翼——Jane Street 九年量化老兵,后来做过量化机构联合创始人。6月团队一口气放出研究员、工程师、产品经理三个岗位,崔添翼自己还在社交平台上感叹"人手很缺,每天都在面试"。

8月1日他发帖招募内测,条件就一条:参与过开源 Agent 项目的建立维护,交 GitHub 代表作。结果这条帖 47.6 万浏览、近 700 条回复,评论区直接变成开源 Agent 项目的路演现场——LLaMA-Factory 作者、LobeHub、字节的 deer-flow、elizaOS 核心成员全来了。有媒体统计,报名者手里的仓库加起来超过 120 万 Star。你想测别人的 harness,别人先把你摸底了。两个月后,这支小团队把答卷交了出来。

框架只是上半场,模型也放了

同一天,DeepSeek 把 V4 Pro 正式版也放了出来(之前是预览)。跑分挺实:DeepSWE 从预览的 12.8 跳到 62.7,Terminal Bench 2.1 干到 87.9,Cybergym 83.3。API 还顺手支持了 OpenAI 的 Responses 格式,给 Codex 留了一键配置脚本。

价格上也动了刀子:8月16日起搞峰谷定价,闲时输出 token 只要峰值的一半。模型便宜、框架免费、还能自己托管,这套组合拳打出来,想避开厂商锁定的团队基本没理由拒绝了。

把镜头拉远:同一周三家在打仗

把镜头拉远一点,8月13到14日这周,基本是"编程智能体军备竞赛"集中爆发。

DeepSeek 开源的第二天,8月14日,智谱发了 GLM-5.3,号称当前最强开源编程模型,Cybergym 拿 84.5%,压过 GPT-5.6 Sol 的 83.6%;Google 同一天把 Gemini 3.7 Flash 降价到每百万输入 0.75 美元,明摆着是防御性动作,怕开发者被便宜的开源模型拐跑。

一边是开源中国在攻,一边是闭源巨头在守。这个势头,比单发一个模型好看多了。

别上头,它还是 v0.1

当然也得泼盆冷水。Harness 现在还是 v0.1 早期预览,第三方跑下来反馈有 bug、token 也吃得凶。它证明的是方向,不是今天就能无缝替代 Claude Code。Cordis 那套插件机制很优雅,但生态插件还得长,现在挂上去的轮子还不够多。

我自己的判断:短期里闭源产品(尤其 Claude Code 的代码质量口碑)还是稳的;但中长期看,"模型 + 开源框架"解耦这件事,DeepSeek 算是把门踹开了。你以后选智能体,可能不再是选一个产品,而是选一套能随便换零件的基础设施。

最关键的是它能自己托管,代码和数据不出你自己的服务器。举个场景:你公司用 Claude 写代码,但安全部门不让代码出域。以前你只能妥协用闭源云,或者自己造轮子。现在拉个 dsh,把 Claude 接进开源壳,壳跑在你自己机房,能力还是 Claude 的,控制权在你手里。这对被合规和出海卡着的国内团队,往往比跑分更有吸引力。

所以问题抛给你:开源的壳、还能挂闭源模型,这组合能不能真的掀翻 Claude Code?你是站闭源的稳,还是站开源的自由?评论区聊聊,我看哪个说法能说服我。

展开阅读全文

更新时间:2026-08-17

标签:科技   智能   模型   框架   团队   插件   代码   产品   仓库   开发者   身体

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034844号

Top