免费POC, 零成本试错
FDE知识库

FDE知识库

学习大模型的前沿技术与行业落地应用


收藏

首发体验 | DeepSeek Harness 来了,它不想做下一个Codex

发布日期:2026-08-13 20:53:42 浏览次数: 2100
作者:APPSO

微信搜一搜,关注“APPSO”

推荐语

DeepSeek首款Agent产品Harness首发体验,区别于Codex,以自定义预设与多模式设计重塑Agent使用习惯。
核心内容:
1. DeepSeek Harness的产品定位与差异化(非Codex类产品,有独特设计)
2. 核心功能模块(会话管理、Agent预设、权限设置等)
3. 四种Agent预设模式(极简、标准、代码、创造)的功能差异

杨芳贤
53AI创始人/腾讯云(TVP)最具价值专家
就在刚刚,DeepSeek 正式发布了首款 Agent 产品,DeepSeek Harness。
早在 V4 Flash 正式版更新日志里,除了直接对标 Claude Opus 模型的 benchmark 成绩,还有一行说明写着「正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 极简模式(即将发布)作为框架进行测试。
APPSO 在发布之前拿到了 DeepSeek Harness 的内测资格,管理项目、长任务协作、多 Agent 编排、上下文管理以及联网搜索和 Skill 等等,这些本地 Agent 工作台该有的功能,DeepSeek Harness 全部都有。
DeepSeek Harness 自己描述的与 Codex 的区别
但如果只是用「DeepSeek 版 Codex」来形容它又肯定不够,自定义的 Agent 预设,可重建的会话,以及强大的插件功能,都让 DeepSeek Harness 变得和传统的 Codex 类产品不太一样。
当 DeepSeek 也开始争夺模型输出之后的 Agent 执行层,这个姗姗来迟的 Harness 除了可以让手上本就「物美价廉」的 DeepSeek 模型更好用,更重要的是,它或许会改变我们使用 Agent 的习惯。
先来认识一下 DeepSeek Harness
以下功能和界面等内容均来自内测版,可能与正式版略有出入,以正式发布的版本为主。
第一眼看和市面上大多数的本地 Agent 产品没什么两样,左侧边栏从上到下依次是「新建会话」、「工作区」,以及不同工作区/文件夹内的多个会话。
对话的设置部分,我们可以切换不同的工作区,不同的模型和思考深度,一共有 Off、High、Max 三档推理等级,还有允许 DeepSeek Harness 可访问的权限。
和一般的 Codex 产品只区分日常/办公、办公/代码等工作场景不同,DeepSeek Harness 使用一套「Agent 预设」来应对不同的任务
在 V4 Flash 正式版中提到的极简模式(minimal),正是 Harness 内置的四种 Agent 预设之一,它适合用于简单修改、测试最小 Agent,没有压缩、搜索、Skill、计划和子 Agent 这些功能。
写作工作台是我们自己创建一个 Agent 预设
另外三种预设模式分别是适合用来日常写代码、修 Bug、分析项目,以及默认选择的标准模式(standard);处理大批量搜索、并行读取和多步骤自动处理的代码模式(code);以及能开发新的 Agent 预设或插件的创造模式(cordis)。
不同的 Agent 预设模式可使用的命令不同,我们也可以直接在输入框内使用「/」快速选择不同的指令或 Skills。
标准模式、代码模式和创造模式,都包含有对话压缩、目标、计划等命令,而极简模式下,只有目标命令。
用创作模式自定义 Agent 预设
对于什么是 Agent 预设,以及几款 Agent 预设的具体区别,我们还能在设置页面看到详细的情况。
预设即一个会话的 Agent 所运行的插件组装 —— 它的工具、提示词与能力。复制一份既有预设改成自己的,或用「创造模式」让 Agent 帮你创建。
如果说模型等于大脑,决定基础的推理和理解能力;Skill 等于一份操作手册,告诉模型遇到某类任务时,具体怎么做;Tool / 插件 相当于软件和权限,它决定了模型能否搜索、改文件、运行命令、收发邮件等。
那么 Agent 预设就是一个岗位+工作环境,身份、长期规则、可用工具、工作方式,都由 Agent 预设决定。
一个 Agent 预设通用由一份配置文档构成,文档内把 Agent 的系统提示词、工具、上下文压缩和多 Agent 能力完整组合起来。
我们也新建了一个专门用于写作的 Agent 预设,在这份预设内,不仅可以使用文件进行配置,还能引入文件夹,加入不同的 Skill,来让自己的 Agent 更加完善。
自定义写作工作台 Agent 预设文件夹内包含的信息
DeepSeek Harness 内也提供了「用创作模式自定义预设」的方法,就像大多数 Agent 用对话创建 Skills 一样,我们可以一步步要求 Harness 创建一个自己的 Agent 预设。
在设置页面,我们还能看到模型的配置,DeepSeek Harness 允许我们接入不同的第三方大模型,默认提供方包括 Kimi、OpenAI、Anthropic、Google 等将近 40 个大模型厂商。
一切都是插件化运行
最后一项设置是 DeepSeek Harness 这次的重头戏——插件,DeepSeek Harness 在内测产品中介绍里写着「Everything is a plugin」,一切皆插件。
这个插件有多离谱,在内测的项目仓库里,参与内测的用户短短几天的时间就已经开发了约 300 个插件。
有的插件能把 DeepSeek Harness 整个的工作界面修改,有的可以像 Codex 一样接入自定义桌面宠物,还有针对对话界面的优化,以及为 DeepSeek Harness 带来「跨会话长期记忆 + 后台自我进化」能力的纯插件实现。
虽然最底层的记忆依然是本地文件,但这套插件并没有把「长期记忆」做成传统的向量数据库 + RAG,而是通过本地文件持久化 + 分层上下文注入 + LLM 自我整理,形成的一套完整系统。
插件的能力还在于能实现模型的自我进化,定期让 LLM 回头审视自己的完整工作上下文,把临时经验压缩成长久知识。
使用该记忆插件的 DeepSeek Harness 界面
但无论是记忆插件,还是皮肤插件,这些都只是插件能力的冰山一角。
在 DeepSeek Harness 的开发文档里,从架构层面来说,插件几乎就是 DeepSeek Harness 的主打,模型、工具、策略、存储、上下文和界面都能通过插件进行替换或组合。
通常我们理解的插件是给当前的产品增加一些小功能,就像 VS Code 里有着丰富的插件系统,或者是 Chrome 浏览器,我们能安装不同的插件,增加浏览器对应的能力。
Codex 应用内也有大量的插件,像是计算机使用、Chrome、Notion 等等对应不同的工具和服务。
但 DeepSeek Harness 这次给出的插件,是在 Agent 的大脑、工具箱、规则和界面里加能力,它更深入、更自由。
如果你嫌 DeepSeek 官方界面太简洁,不妨加点广告。
内测用户自己开发的 DSH 插件,能够直接修改页面 UI
举个例子,一个 Agent 的「标题生成插件」,通常是在对话里增加一个按钮或命令,点击后调用 AI 根据已有命令处理。
一个 DSH 的「写作插件」,则可能同时做到:给 Agent 增加 /headline 等能力;注册一个模型可以自主调用的标题工具;换掉系统提示词和写作规则;接入我们的各类 Skills;增加网页检索或外部 MCP;保存文章素材和长期偏好;在 DeepSeek 的交互页面中增加写作面板;限制这个 Agent 可以使用哪些 Shell、文件或网络工具……等等。
市面上插件功能同样强大的产品可能是 Pi Agent,它也可以通过 Extension 改写工具、模型请求、会话行为和终端界面。
Pi 的介绍写着「有很多 Agent,但这个才是你的」
Pi 让一个 Coding Agent 可以任意扩展;DSH 则试图让整个 Agent 产品都由插件重新组合。
用起来怎么样
很难想象吧,以快著称的 DeepSeek,有一天运行一项编程任务的时间也会来到半个多小时。
为了观察执行层能给同一个模型带来多大变化,我们让 DeepSeek-V4-Flash 分别在 DeepSeek Harness、Reasonix 和 Codex 中完成同一个 Three.js 滑沙游戏。
先看使用 V4 Flash 在 DeepSeek Harness 中的表现,基本上没有太多可以挑剔的 Bug,玩家一开始就在滑行,完全遵守核心玩法,穿过下坡途中的每个门,最终抵达沙漠绿洲。
而使用刚刚上新的 V4 Pro,用时更长,表现反而更没那么好。
虽然界面似乎有更加精美了一点,太阳光沙漠都更自然,但是金字塔等元素又很抽象。
使用 DeepSeek V4 Pro 正式版,在 DeepSeek Harness 内生成
Reasonix,据说是最适合 DeepSeek 的第三方 Agent ,我们让它处理了同一个任务,看看 V4 Flash 正式版模型,在不同的 Harness 应用中,表现会有什么不同。
同样是最高等级的推理,差别真的很大。
首先是整体画面的美感就完全不如 DeepSeek Harness 所交付的「金黄、快速、阳光明媚、清晰明朗」,其次虽然游戏同样能玩,但是太过于简陋,渲染的金字塔、人物、天空都很粗糙,不像是一款 3D 游戏。
而如果是 Codex+DeepSeek V4 Flash 的组合呢,一开始我们在本地新建了一个文件夹,Codex 的处理方式很聪明,他说他自己先扫描了一遍本地文件夹,发现了另一个项目中存在一个 3D 库的复制文件。
接着他又找到了我使用 DeepSeek Harness 创建的 pyramid-speed-run 项目,他说他要先看看那个是怎么处理 3D 库文件的,但是他不会直接复制,然后把那个项目作为一个原型参考,开始构建自己的项目。
一个是允许他继续参考做出来的网页,一个是我们新开了一个对话,让 Codex 完全依靠自己的工具处理的网页。
使用 V4 Flash 正式版的 Codex,干净工作区组
使用 V4 Flash 正式版的 Codex,受污染上下文组
两个版本似乎都比用 Reasonix 要更好,和 DeepSeek Harness 版本相比,似乎还是 Harness 版本给人沉浸感更强。
「受污染」版把色彩调好的同时,但是金字塔完全不像是金字塔。而从 0 开始做的版本确实有 Codex 的感觉,整体画面更明亮,也更简单。
就像 V4 Flash 使用极简模式的 DeepSeek Harness 进行评测能得到更好结果。
这个单次案例虽然无法证明 Harness 在所有任务上更强,但至少说明:当模型完全相同时,Harness 提供的工具、提示词、上下文组织和执行策略,已经足以显著改变最终产物。
它不是 DeepSeek 版 Codex
查看 DeepSeek Harness 仓库中大量的 Markdown 说明文档,以及使用指南等内容,可以很确定地说,DSH 不是「DeepSeek 版 Codex」,它更接近一套可重组、可回放的 Agent 运行时。
DeepSeek Harness 真正特别的地方,是把「插件生命周期、每个 Agent 的能力组合、工具执行、会话日志、Web UI」接进了同一套内核
从底层的技术配置到如何处理用户交互、AI 交互,DeepSeek Harness 都有自己独特的一套流程。
图片由 AI 生成
DeepSeek Harness 最重要的插件功能,根据其文档介绍,它并不只是一个 API 接口,每个工具、模型适配器、策略、提示词、存储、UI 区域都可以是插件。
就像我们看到,已经有内测用户能通过插件,修改 DeepSeek Harness 的主界面。
其次是 Profile 和 Preset 构成的两级组合系统,Profile 决定整个 DSH 进程怎么运行,例如 Web、Headless、安装哪些 Bundle,它本质上是有顺序的 cordis.patch.yml 配置层。
Agent Preset(Agent 预设)决定某个会话里的 Agent 能看到哪些工具、提示词、Skill、子 Agent 和工作流。Preset 的作用域按 agent → preset → global 解析。
根据 Preset 作用域机制,意味着同一个进程中,可以同时运行写作 Agent、编码 Agent、研究 Agent,而且各自看到不同的工具和指令,不必启动四套服务。
另一个有价值的技术点是「模型可见 ⇔ 已记录」。
普通聊天工具往往只保存最终消息,DSH 保存的是完整事件流: turn/start、step/start 用户消息、实际请求使用的模型、系统提示词、工具定义、原始流式等等内容。
同时甚至上下文压缩也不会删除原始历史,只是用 replacement 事件改变模型此后看到的「表面」。
DSH-better-sidebar 插件,将 DeepSeek Harness 界面修改为多个侧边栏的 UI
还有采用「先记录意图,再执行副作用」的 Agent Loop,以及所有工具共用一条执行内核。即模型可以写一段 TypeScript,把多个工具调用编排成程序,但中间数据留在运行环境里,只有最终结果进入模型上下文。
最后一项特别设计就是前端,即我们使用 DeepSeek Harness 的界面,DSH 并不是一个传统的「固定前端页面 + 后端插件」,界面本身也是第二棵插件树。
图片由 AI 生成
应用启动后,界面挂载机制会加载一组 UI 插件。页面先声明侧边栏、对话区、输入区和设置区等标准挂载位,各插件再把自己的组件注册进去。
MCP、Skill、网页搜索、终端、子 Agent、多模型、Plan Mode、Workflow,这些单独看都已经是 Agent 产品的常见能力。
DeepSeek Harness 的不同在于它把模型、工具、会话、插件和界面,都接入统一的底层机制。
而这带来的最大改变,大概是以前我们是使用一个通用 AI Agent,每个人都在用一样的 Codex 去处理办公、编程、写作等任务;但 DeepSeek Harness 给我们的是自己探索的空间。
总的来说,Codex 尝试交付一个拿来即用的 Agent;DeepSeek Harness 更像一套组装 Agent 的运行时:它把更多结构暴露出来,让开发者决定 Agent 应该是谁、使用什么工具,以及如何工作。
既然 Codex 可以切换不同的模型,模型只是 Agent 的一个部件,那 Agent 本身也应该能持续配置、替换和重组
DeepSeek 过去最受关注的是模型本身。现在到了 DeepSeek Harness,它开始处理模型之外的问题:如何组织工具和上下文、保存执行过程,以及在同一套系统里配置不同的 Agent。
以前我们挑 Agent,挑的是哪家公司做出了最好用的那个产品。
DeepSeek Harness 给出的另一种可能是,Agent 和模型同样是基础设施。开发者和用户,可以使用 DeepSeek Harness 创造出无数个 Codex,而真正属于我们的 Agent,也可以由自己组装出来。

53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询

扫码登录
登录即表示您同意《53AI网站服务协议》
服务协议

欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。

在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。

一、 定义

本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。

会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。

知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。

二、 账号注册与登录

登录方式:本网站支持以下登录方式,您可根据实际情况选择:

微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。

手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。

账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。

实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。

未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。

三、 服务内容与规范

知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。

服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。

禁止行为:您在使用服务时不得实施以下行为:

利用技术手段批量爬取、下载、转存知识库内容;

将知识库内容用于商业目的或未经授权地向第三方传播;

干扰本网站正常运行或侵犯其他用户合法权益;

发布违法违规信息或从事违反公序良俗的活动。

四、 知识产权声明

权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。

有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。

侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。

五、 个人信息保护

我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。

您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。

您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。

六、 免责声明

内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。

不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。

第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。

七、 违约责任

如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。

如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。

八、 法律适用与争议解决

本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。

因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。

九、 其他

本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。

本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。

我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。


已查阅