欧巴聊AI
26-08-14 00:39 微博认证:AI博主

深夜惊喜,DeepSeek Harness 来了。

终于能说了,前阵子有幸参与了官方的内测。

如果用一句话总结体验,那就是国产 Harness 牛逼。

什么 Claude Code,Codex,巴拉巴拉,统统都开始等着颤抖吧。

从此,Harness 圈儿有了自己的龙妈。

不开玩笑,DeepSeek Harness 采用了一切皆插件的设计思路。

模型,工具,技能,会话,沙箱,存储,循环,调度,UI 等所有的 Agent 能力,都是由插件组合起来的。

好处是,你可以自由替换,随意重组。

话不多说,进入实测边测边聊。

# 实测

在你的电脑安装好 Node.js,然后运行下面的命令,就能一键启动 Web UI 了。

```
npx @deepseek-ai/dsh web
```

复制命令行里的地址,到浏览器打开,在左下角的设置里填好 API 密钥,就可以开心地玩耍了。

整体的首页是长这样的,左边是会话工作区,右边是对话区。

第一步,你需要选择一个工作区,也就是你本地的文件夹。

细节来了,针对不同的场景,DeepSeek Harness 提供了四种运行模式。

注意,每种模式都会默认加载不同的插件集合。

其中,标准模式会提供最完整的工具集合。

PTC 模式是程序化工具调用,由模型生成的一段 TypeScript 代码来组合多轮的工具调用。

极简模式中,只保留了一个 shell 工具和一个文件编辑工具,用于最小环境下的模型基准测试。

创造模式的话,能检查当前的运行时,在内存中做插件实验,并且根据此组合创造出全新的自定义模式。

所以如果你只是想日常使用的话,选择标准模式即可。

输入框左下角这里的加号,目前是快捷指令,你既可以点击选择,也可以通过 /指令名字 的方式直接输入。

compact 是压缩较早的对话历史,来节省上下文空间。

export 是将当前会话日志下载为 ZIP 压缩包。

feedback 是记录关于此会话的反馈。

goal 是设置长期任务的目标,适合不达目的不罢休的复杂任务。

permission 是切换权限,包括只读,在当前工作区中写入和完全访问。

plan 是进入或者退出计划模式。

model 是选择当前对话要使用的模型。

输入框的右侧这里,也可以选择模型和对应的推理等级。

好了,配置项聊到这里,直接上保留节目,在网页里模拟 3D 火山喷发。

干活的时候,会先将各种插件注入上下文,然后开始深度研究,也就是显示为蓝色的 Deep diving 状态。

直接来看结果,我录了一个视频。

啊?????????????

这就是 DeepSeek V4 Pro 正式版加上 DeepSeek Harness 的威力吗?

这个效果和颜值美学不用我多说了吧?

怎一个夯字了得。

值得一提的是,模型能够看到的一切东西,都会写入会话日志。

这个会话日志是写入仅追加的,包括系统提示词,思维链,工具调用与结果,子 Agent 调度,以及每一次上下文注入。

你可以在轨迹视图中,原原本本的查看到这些信息。

所有的会话操作,包括恢复,分叉,检索与回放,也都是共享同一份事件流。

对了,还记得吗?

DeepSeek Harness 所有的 Agent 能力,都是由插件组合起来的,你是可以自由组合和替换的。

来看几个内测小伙伴做的插件,感受下自由的感觉。

是的没错,太抽象了,太喜欢了。

这就是自由的感觉,自由就意味着你可以为所欲为的发挥想象力。

想自己开发插件的话,可以让你的 Agent 去读官方仓库的文档,已经写得非常详细了。

目前官方开源的是 DeepSeek Harness 的开发者预览版,v0.1 版本。

当前还有很多细节有待改进和打磨,核心插件和基础接口也会在后续快速迭代演进。

如果你感兴趣的话,欢迎来玩,跟社区一起共建生态。

# 尾声

最后的最后,要特别感谢这位宝藏内测同学,给大家精心制作的合影墙。

下图是部分合影。

#DeepSeekHarness发布##how i ai#

发布于 北京