DeepSeek 前几天开源了 DeepSeek Harness。这个时间点其实有点微妙:harness 已经是个泛滥的品类了,闭源的有 Claude Code、Codex,开源的克隆也有一大
<div class="detail-content-box has-mask large">
<section data-layout-id="0" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf=""><a href="https://www.53ai.com/news/tishicijiqiao/2025020128143.html">DeepSeek</a> 前几天开源了 DeepSeek Harness。这个时间点其实有点微妙:harness 已经是个泛滥的品类了,闭源的有 Claude Code、Codex,开源的克隆也有一大把,市面上并不缺"又一个 harness"。那它的创新点是什么?</span></section><section data-layout-id="1" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">答案在它的口号里:一切皆插件。别家的 harness 是一个做好的产品,它是一堆可以自由拼装的零件。模型是插件,工具是插件,会话存储是插件,上下文压缩策略是插件,连最核心的 <a href="https://www.53ai.com/news/LargeLanguageModel/2024052823549.html">Agent</a> 循环本身,也是一个可以整体换掉的插件。它甚至能把 Claude Code 和 Codex 当成自己的子 Agent 调用,别人的产品成了它的一个零件。</span></section><section data-layout-id="2" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">先看下 Claude Code 和 Codex 是怎么设计的:这两个产品都留了扩展空间,但留得非常克制。你可以接 <a href="https://www.53ai.com/news/OpenSourceLLM/2025041527018.html">MCP</a> 加外部工具,可以写 Skills 沉淀常用流程,可以在配置文件里立规矩,Claude Code 还有 Hooks 让你在一些节点挂自己的脚本。听起来不少,但这些口子全开在边缘上:你能决定它用什么工具、守什么规矩,却碰不到它的内脏。循环怎么跑、上下文怎么压缩、什么时候把哪些历史送给模型,这些最核心的机制是定死的,一行都改不了。</span></section><section data-layout-id="3" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">打个比方,Claude Code 给你的是一台密封的主机,机身上留了几个 USB 口,键盘硬盘随便插,但主板和 CPU 焊死在里面。DeepSeek Harness 给你的是敞开的机箱,主板、CPU、内存条全都能拔下来换。</span></section><section data-layout-id="4" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">得说清楚的是,焊死不是偷懒,反而是这类产品好用的原因。harness 和模型是一起调出来的,模型训练时就泡在这套工具和提示结构里,一体成型才有最优配合。对一个只想把活干完的人,可换性没有价值,只有装配成本。</span></section><section data-layout-id="5" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">那么问题来了:谁真的需要一个连内脏都能换的 harness?</span></section><section data-layout-id="6" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">判断标准其实就一条:你要的东西,是不是"一个换了皮的编程助手"。如果是,你有的是选择,犯不着自己拼机箱。只有当你要造的 Agent 连形状都和编程助手不一样的时候,那些定死的内脏才会变成真正的墙。我能想到三种人已经撞在这堵墙上了。</span></section><section data-layout-id="7" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">第一种,造"形状不一样的 Agent"的人。Claude Code 的整套内核,是围绕"一个人开一个会话、干几十分钟的编程活"设计的:压缩策略假设上下文是代码和报错,循环假设有个人坐在对面随时补充指令,停止条件假设活干完了就该收工。可有些 Agent 天生不长这样。一个要连续值守几周的运维 Agent,需要的是分层的记忆和睡眠唤醒机制,而不是为编程会话调的压缩策略;一个同时应对几千路对话的客服 Agent,循环的开销结构和单人会话完全是两回事。这些需求在焊死的 harness 里没法表达,改内脏是唯一的出路。</span></section><section data-layout-id="8" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">第二种,训练和研究模型的人。模型不是在真空里学会干活的,它是在某一套 harness 里被训练出来的,harness 就是模型的健身房。你要训自己的模型,就得有一间自己说了算的健身房,每个器械都能调。DeepSeek 自己就是第一个用户,V4-Pro 就是在这套 harness 里调出来的;做 Agent 评测的人也一样,评测要可复现、可插桩,黑盒产品给不了。以前这间健身房每个实验室都得自己盖,现在有了开源的图纸。</span></section><section data-layout-id="9" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">第三种,把 token 当成本中心的人。个人用户感觉不到内脏的差别,但一天跑几万个 session 的团队感觉得到:压缩策略贴不贴合自己的负载,缓存命中率是六成还是九成多,简单步骤能不能路由给便宜的模型,这些都是账单上的真金白银。这类调优全都发生在内脏层,产品化的 harness 一个接口都没给你留。</span></section><section data-layout-id="10" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">这个格局似曾相识。Docker 当年是人手一份的好产品,Kubernetes 是个人用起来复杂的框架,一切皆可插拔,装配成本极高。但企业的生产环境最后全跑在了 Kubernetes 上,因为生产环境要的恰恰是那些个人用不到的东西:可以换的存储后端、可以插的网络、全链路的管控。</span></section><section data-layout-id="11" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">DeepSeek Harness 想当的就是 Agent 时代的 Kubernetes。它赌的不是做一个更好用的工具,而是赌 Agent 会从个人手里的工具,变成一种要被训练、被调优、被大规模运维的基础设施。基础设施这一层,历史上从来不接受焊死的黑盒。</span></section><section data-layout-id="12" style="font-size: 17px;font-weight: 400;color: rgba(0,0,0,0.9);line-height: 1.8;margin-bottom: 24px;"><span leaf="">当然,现在下结论还早。它只是 developer preview,官方自己都警告随时有破坏性变更,沙箱还很粗糙,插件生态怎么治理也没有答案。所以,有谁会用 DeepSeek Harness?今天的诚实答案是:我们这种普通开发者大概率不会,该用 Codex 还用 Codex。但对harness高定制有实际需求的人来说,deepseek harness的出现确实很重要。未来能走多远,拭目以待。</span></section><p style="display: none;"><mp-style-type data-value="3"></mp-style-type></p> <div class="content-mask">
<a href="javascript:void (0);" class="mask-text login-trigger">
<i class="iconfont icon-suo"></i>
登录查看剩余 70% 内容
<i class="iconfont icon-arrow-right-o"></i>
</a>
</div>
</div>
</div>
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断