DeepSeek 开源 Harness,Agent 的底层能力正在被进一步标准化;对 XunOPC 来说,重点也变得更清楚——以后“能做 Agent”会越来越容易,真正要比的,是谁能把事情做完。
DeepSeek 把 Harness 开源了,XunOPC 能从中看到什么?
一句话先说结论:Agent 会越来越容易做,真正难的是把事做好。
DeepSeek 最近开源了自己的 Agent Harness,目前还处在 Developer Preview 阶段。它解决的不是模型本身,而是模型外面的那一层:怎么接工具、怎么管理任务、怎么保存上下文、怎么调用文件和命令,以及怎么让 Agent 持续把一件事情往下做。
这也是为什么 Harness 最近越来越值得关注。模型会写代码、会分析问题,已经不算特别稀缺,真正放进工作里以后,还会碰到很多更具体的问题。任务怎么拆,文件怎么改,做到一半失败了怎么办,哪些操作可以让 AI 自己执行,哪些必须等人确认,这些都不是单纯换一个更强的模型就能解决的。
它和 XunOPC 是什么关系?
DeepSeek Harness 和 XunOPC 有一些能力会碰到一起,但两者并不是同一种产品。Harness 更接近给开发者使用的 Agent 基础框架,开发者可以基于它接模型、接工具,再继续往上搭自己的 Agent。
XunOPC 更靠近实际使用这一层。一个任务进来以后,用户关心的不只是模型会不会做,还包括任务怎么推进、不同 Agent 怎么分工、修改了哪些代码、人什么时候需要介入,以及出了问题以后能不能找回来。
之前我们用 XunOPC 测过一个真实项目,里面有 583 个 Java 文件、112 个 Vue 文件和 131 个 TS 文件,让它直接检查并修复 BUG。最后真正有价值的,不只是找到了问题,而是从检查、修改到人工确认,整个过程能够继续往下跑,修改记录能看,结果也可以撤销。
Harness 开源以后,XunOPC 要比什么?
DeepSeek 把 Harness 开源以后,做一个能够调用工具、读写文件、执行任务的 Agent,门槛肯定会继续降低。以后“我们也有 Agent”“AI 也能写代码”这种能力,本身会越来越难成为产品差异。
真正要比的会更实际。一个复杂任务交进去以后能不能持续做完,多 Agent 同时工作会不会互相影响,关键操作能不能让人及时介入,出了问题能不能追溯,跑通过一次的工作方式以后能不能继续复用。
这些东西单独看都不算特别新,但真正组合到一起,并且让普通用户不用研究 Agent 框架就能直接开始工作,才是产品需要解决的问题。
回到 XunOPC
DeepSeek Harness 的开源,其实把 Agent 这条路讲得更清楚了。以后底层能力会越来越开放,能搭 Agent 的人也会越来越多,竞争自然会继续往上走。
对 XunOPC 来说,接下来需要证明的也不是“我们能不能做 Agent”,而是能不能把一个真实任务从头到尾跑下来,让用户看得见过程,也敢把下一件事情继续交给它。
从“能跑”到“能用”,可能才是接下来真正的差距。