
8 月 13 日晚上DeepSeek 做了一件出乎很多人意料的事。不是又发布了新模型——同一天上午V4-Pro 已经正式转正了。而是把一个叫DeepSeek Harness的东西开源了。MIT 协议代码全部公开。两天后GitHub 上10.9 万颗 Star。很多人第一反应是DeepSeek 终于有自己的 Claude Code 了。但这个判断只对了一半。Claude Code 是成品打开就能用DeepSeek Harness 做的事更底层——它开源的不是一个工具而是工具的骨架。这篇文章不写安装教程只想把一件事讲明白Harness 到底是什么为什么说它是 AI 智能体的骨架一切皆插件又是什么意思一、先搞懂一个词Harness“Harness” 英文原意是马具——把马的力量接到车上、控制住它别脱缰的那套装置。落到 AI 上意思一下就通了模型负责想Harness 负责让想做的事在真实世界里发生同时不让它乱来。再直白一点。你平时用的聊天机器人吃进一个问题吐出一段文字就结束了。但一个真正的 AI 智能体Agent不是这样它要反复走完一条环理解任务 → 找文件 → 改代码 → 跑命令 → 看结果 → 再改这条环上的每一步都需要和真实环境打交道读懂文件系统、执行终端命令、调用外部工具、管理上下文、控制权限。而模型本身是碰不到这些的——它只会想不会做。把想和做接起来的中间层就是 Harness。所以行业里流行一个公式Agent 模型 Harness模型给智能的上限Harness 给智能一个身体。二、一切皆插件到底是什么意思这是 DeepSeek Harness 最核心的设计理念也是它和所有现有工具的根本区别。先看看别人家是怎么做的。Claude Code、Cursor、Codex 这类工具模型、工具、界面、运行逻辑全都焊死在一起。你想换掉其中某一层几乎不可能——它们是一个封闭的整体。DeepSeek Harness 的思路完全不同模型、工具、技能、会话、沙箱、存储、循环、调度、UI——全部是插件。DeepSeek Harness 官方插件管理界面截图共 132 个插件每个插件可独立启用或停用打个比方。别人家的 Agent 是一台整机出厂的笔记本电脑主板、显卡、屏幕焊死想升级只能整机换。DeepSeek Harness 是一台可以自由组装的台式机甚至更极端——它连主板本身都是可以换的。想换模型拔下来换一个。想换沙箱拔下来换一个。每个能力都是配置里的一行声明不用动一行源码。支撑这套设计的是一个叫Cordis的插件内核来自北京大学和 DeepSeek 联合发表的论文。它的厉害之处在于插件不仅能装得上还能卸得干净——卸载时它留在系统里的所有影响都会被完整撤回系统回到装它之前的状态。在传统插件系统里卸载一个插件往往要重启整个软件。但对 Agent 来说重启意味着正在跑的长任务、缓存、子进程全部丢失。DeepSeek Harness 解决的正是这个问题插件动态装卸运行不中断。三、一个框架四种人格DeepSeek Harness 出厂自带四种运行模式每种加载不同的插件组合就像同一个人换了四套不同的行头模式一句话理解用在哪儿标准模式什么都会的全能选手日常写代码、改项目默认选它PTC 模式会写程序来调工具的程序员批量操作、多步任务省时间省 Token极简模式只留两个工具的极简主义者基准测试测模型真实能力创造模式能造 Agent 的造物主定制自己的 Agent 预设其中最有意思的是创造模式——它让 Agent 可以检查自己正在运行的身体试着挂个临时插件跑跑看不行再卸掉。换句话说Agent 可以自己改装自己。而在极简模式里DeepSeek 只给模型留下两个工具一个命令终端、一个文件编辑器。为什么要这么极端因为这样才能在一个受控的环境里测出模型的真实能力——剥离所有辅助看它裸奔能跑多远。事实上DeepSeek 自家模型的编码能力基准测试用的就是这套极简环境。四、为什么说每一次运行都有迹可循这是被很多人低估的一个设计。模型在干活的时候它看到的一切——系统提示词、思考过程、工具调用与结果、每一步决策——都会写进一份只能追加、不能篡改的会话日志。在 Trajectory 轨迹视图里你可以像看回放一样查看这次运行的完整过程DeepSeek Harness 官方 Trajectory 轨迹视图按时间轴展示每一次系统提示、用户消息、工具调用及其结果这意味着什么一次任务失败了你可以回放整个过程看它到底在哪一步走偏了。可以从出错前的任意节点分叉换一条路重新试原始记录不受影响。可以跨会话搜索找到某个决策是在什么背景下做出的。对普通用户来说这让你能看清 AI 到底在做什么而不是对着一个黑盒瞎猜。对开发者来说这是调试和审计的刚需。大多数 Agent 框架把日志当作事后补丁DeepSeek Harness 把它当核心架构原则。五、为什么要关注这件事把视线拉远一点看。2024 年大家还在争论谁的模型更强。到了 2026 年战场已经转移到了模型和真实环境之间的那一层——谁能让 AI 真正干成事而不是只会说得好听。Anthropic 有 Claude CodeOpenAI 有 CodexDeepSeek 现在有一套自己定义的执行层——并且把定义公开了。公开才是这次开源和再做一个编程助手的真正差别。当 Agent 的骨架变成开源的、可组合的、可追溯的受益的不只是 DeepSeek 的用户而是整个 Agent 生态开发者可以研究它、魔改它、为它写插件社区的力量会像滚雪球一样滚起来。也有人把它比作Agent 时代的安卓——不是苹果那种封闭的生态而是一个开放的操作系统人人可以参与改造。这个比喻不一定精准但方向是对的。当然也要清醒看待目前它还是开发者预览版官方明确提示会有兼容性破坏的变更不适合直接绑进生产系统。但这不妨碍它值得被看见、被研究。写在最后一句话总结 DeepSeek Harness它把让 AI 干活这件事从一家公司的黑盒变成了全世界开发者都能参与拼装的积木。模型负责想Harness 负责做模型给智能上限Harness 给智能身体——而这个身体现在开源了。官网https://www.deepseek.com/harness/GitHubhttps://github.com/deepseek-ai/deepseek-harness