微信扫码
添加专属顾问
澄清Agent工程三大概念混淆,用Harness/环境、Loop/反馈、Graph/流程三层架构解析各自作用,助你理清可靠Agent工程关键。 核心内容: 1. 澄清Harness、Loop、Graph的常见混淆现状 2. 三层架构定义:Harness管环境与运行基础设施,Loop管重复执行与反馈验证,Graph管流程拓扑与状态迁移 3. 可靠Agent工程关键:环境、反馈、流程需共同工程化,非仅依赖模型升级
Agent 工程里最容易出现的误解,是把所有“让 Agent 更可靠”的代码都叫成一个东西。
有人把工具调用叫 Agent Loop,有人把多步骤流程画成 Graph,也有人把系统提示词和记忆模块叫 Harness。它们确实都围绕同一个模型,都可能包含“循环”,也都会影响最终可靠性,但解决的是不同层级的问题。
可以先记住这组三句话:
更简洁地说:
Harness 管环境,Loop 管反馈,Graph 管流程。
图:原文用“environment → feedback → flow”概括三层工程关系。
这三个词目前还没有完全统一的行业标准。尤其是 Loop Engineering,它是实践者在 2026 年逐渐使用的新说法;Graph Engineering 也更接近一种实用工程方法,而不是一个边界严格的学术领域。
但这种区分非常有用,因为它能防止“Agent”这个大词掩盖真正的设计问题。
一个裸的语言模型只能根据输入生成输出。它不会天然拥有以下能力:
这些能力来自模型所处的环境,也就是 Harness。
在 LangChain 的定义里,Agent 可以理解为“模型 + Harness”,而 Harness 就是模型之外的代码、配置和执行逻辑。OpenAI Agents SDK 也从运行时角度描述了类似的核心:Runner 调用模型、执行工具调用、处理 handoff、携带状态,并且只有在真正达到终止条件时才停止。
一个严肃的 Agent Harness,至少会处理以下六类问题:
包括系统指令、检索结果、对话状态、技能、任务策略和权限规则。
包括 API、浏览器、Shell、代码解释器、数据库和兼容 MCP 的工具。
包括文件、检查点、会话、进度日志、Git 历史和长期记忆。
包括超时、重试、预算、模型路由、子 Agent、审批门和并发控制。
包括权限、隔离、Allowlist、Secret 管理和人工授权。
包括 Trace、工具输入输出、状态迁移、成本、延迟和评测结果。
图:Harness 不是一段循环代码,而是围绕模型的完整运行系统。
因此可以做一个很实用的判断:
把模型从架构图里拿掉之后,剩下的工具、数据访问、状态存储、沙箱、中间件、评估器、重试策略和 UI,基本都属于 Harness。
两支团队使用同一个基础模型,最后效果可能完全不同。
一支团队给模型准备了干净的工具、稳定的工作区、受限的权限、可观察的状态和清晰的终止条件;另一支团队只给了一个模糊提示词和不稳定的 API 包装层。模型智力相同,但工作环境不同,结果当然也会不同。
这就是 Harness Engineering 的核心价值:它把模型能力转化成可重复运行的系统能力。
每个会使用工具的 Agent,其实都带着一个小循环:
当工程师开始有意识地设计、叠加和管理这些循环时,就进入了 Loop Engineering。
它的重点不是“多写一个 while 循环”,而是回答几个问题:
可能是用户请求、定时任务、测试失败、新数据到达或评估器反馈。
必须是一个具体的可判断状态,而不是“继续改进”这种模糊命令。
下一轮需要知道什么?哪些内容不必重新播放?哪些中间结果需要持久化?
Agent 可以修改什么、调用什么、委派什么任务,以及可以花费多少预算?
包括测试、Schema 校验、引用、Diff、指标或人工审核。
反馈不能只是“失败了”,而要告诉 Agent 为什么失败、下一步可能修正什么。
成功、预算耗尽、超时、不可恢复错误或需要人工升级,都应该是明确的终止条件。
这是原文最值得记住的一句话:
不要让 Agent 围绕自信程度循环,要让它围绕证据循环。
“Agent 说自己完成了”不是停止条件。
更可靠的停止条件应该是:
图:一个典型的验证循环,会把模型产物交给外部检查器,而不是只听模型自己宣布成功。
Agent 创建一个产物,运行确定性检查或评估器,获得明确反馈;只有在证据失败时才继续修改。
当定时任务、Webhook 或新文档到达时唤醒 Agent。
分析 Trace 和失败原因,修改指令或工具,再测试新版本是否确实更好。
这些循环的代价也必须计算:每多一个评估器、审查者或重试,就可能增加一次模型调用或工具执行。好的工程不是循环越多越好,而是在失败代价高于验证代价的地方增加循环。
Loop 主要关心重复执行和反馈;Graph 关心的是工作流拓扑:当前节点完成后,哪个组件被允许运行?
在 Graph Engineering 中:
这让流程从一段隐含在代码里的控制逻辑,变成可以检查、测试和审计的显式图结构。
图:Harness 提供能力,Graph 路由工作,Loop 负责在条件不足时重新执行。
假设我们要构建一个研究报告 Agent,它可能包含这样的 Graph:
任务拆解
↓
并行检索多个来源
↓
来源质量筛选
↓
证据聚合
↓
草稿生成
↓
事实核查
↓
人工审核
↓
发布或退回修改
这里有三种不同的工程问题:
如果把这些都塞进一个大提示词,模型也许能在演示中完成任务,但流程很难审计;如果把所有问题都写成一个无限重试循环,又可能造成费用失控、状态污染和无法终止。
图:原文对三种方法的关注点、构建模块和主要风险进行对比。
这张表也说明,三种工程方法不是互相替代关系,而是可以叠加:
Graph:决定流程怎么走
↓
Loop:决定失败后怎么反馈和重试
↓
Harness:提供工具、状态、权限和执行环境
实际系统里,它们通常是嵌套的。一个 Graph 节点内部可能运行一个 Loop;整个 Graph 又必须运行在 Harness 提供的环境中。
适合使用 Harness Engineering 的情况包括:
如果问题是“Agent 根本没有能力完成任务”,增加重试循环通常无效,应该先补齐运行环境。
适合使用 Loop Engineering 的情况包括:
这里的重点是给 Agent 提供可操作的反馈,而不是让它凭感觉继续思考。
适合使用 Graph Engineering 的情况包括:
如果流程只有两个简单步骤,硬画成复杂 Graph 反而会增加维护负担。
很多 Agent 项目把系统提示词写得很长,就认为自己已经完成了 Harness。其实 Harness 的边界远大于 Prompt。
一个更完整的 Harness 还应该管理:
例如,长时间、多会话的代码任务不能只依赖上下文压缩。更好的工作系统会创建初始化器、进度文件和 Git 历史,并要求每一轮增量完成工作。这样,即使进入新的上下文,Agent 仍然能知道已经完成了什么、还有什么没有完成。
这不是更好的 Prompt,而是更好的工作环境。
图:模型嵌入在更大的上下文、控制、行动、持久化和验证系统中。
这三个概念背后,其实是同一个趋势:Agent 的竞争越来越不只是基础模型竞争。
同一个模型,可以被放进完全不同的系统:
最终效果自然不同。
这并不是说基础模型不重要。模型决定了系统的能力上限,但 Harness、Loop 和 Graph 决定了有多少模型能力能够稳定兑现。
可以把最终效果粗略理解为:
Agent 可靠性
≈ 模型能力 × 环境质量 × 反馈质量 × 流程清晰度
这个公式不是严格的数学定律,但它提醒我们:任何一个乘数接近零,系统都会失效。
Prompt 只能描述规则,不能替代文件系统、权限、工具、持久化和可观测性。
没有目标、证据、预算和停止规则的循环,只是故障放大器。
简单任务不需要复杂编排。Graph 的价值来自显式控制,而不是图本身的复杂程度。
模型的自我评价不能替代外部证据。测试、校验、引用、Diff 和人工审核才是可靠的完成条件。
如果团队准备把一个 Demo Agent 变成生产系统,可以按以下顺序推进:
确认模型能访问什么工具、读写哪些数据、使用哪些权限、如何保存状态,以及失败后如何恢复。
为任务定义可验证的完成标准,例如测试通过、JSON 合法、引用可访问、指标达到阈值。
只有在证据失败时继续循环,并把失败原因压缩成下一轮可执行的反馈。
当任务出现分支、并行、汇合、人工审批或回退时,使用节点和边表达流程。
减少无效重试,设置预算和超时,按任务选择模型,必要时把确定性步骤从模型中移到普通代码里。
Harness、Loop 和 Graph 三个概念,实际上是在回答三个不同问题:
把三者混在一起,系统会显得“很 Agent”,但很难解释、测试和维护;把三者分开,工程团队就能更准确地定位问题:
最终,一套生产级 Agent 架构大致可以这样理解:
Harness 提供环境,Loop 提供反馈,Graph 提供方向。
模型仍然是核心发动机,但真正决定它能否在文件、API、客户和生产代码上可靠工作的,是发动机周围那套被认真设计过的工程系统。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-09-12
OpenAI把Codex“拆开卖了”
2026-09-12
Token狂省83%!OpenAI发布Agents API:模型内卷时代彻底终结
2026-09-12
Google Gemini桌面版进化成超级应用,可操控电脑、对接Obsidian
2026-09-12
刚刚,OpenAI重磅上线Agents API:Codex同款底座全开放
2026-09-11
月之暗面的 Kimi Code 和 Kimi Work 正式接入 CloudBase
2026-09-11
Agentic AI 时代拷问:企业级 Agent,到底需要一套怎样的全新基础设施?
2026-09-10
Android Studio Quail 4 稳定版发布: 借助 Android Skills 与 Gemma 4 极速构建应用
2026-09-10
Harness Inspector:让 Agent 交付过程可观察、可检查、可追溯
2026-06-22
2026-09-01
2026-08-31
2026-06-27
2026-06-17
2026-09-01
2026-09-01
2026-09-02
2026-06-24
2026-06-27
2026-09-11
2026-09-08
2026-09-07
2026-09-07
2026-09-02
2026-09-02
2026-09-02
2026-08-31
欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。
在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。
一、 定义
本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。
会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。
知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。
二、 账号注册与登录
登录方式:本网站支持以下登录方式,您可根据实际情况选择:
微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。
手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。
账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。
实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。
未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。
三、 服务内容与规范
知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。
服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。
禁止行为:您在使用服务时不得实施以下行为:
利用技术手段批量爬取、下载、转存知识库内容;
将知识库内容用于商业目的或未经授权地向第三方传播;
干扰本网站正常运行或侵犯其他用户合法权益;
发布违法违规信息或从事违反公序良俗的活动。
四、 知识产权声明
权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。
有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。
侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。
五、 个人信息保护
我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。
您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。
您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。
六、 免责声明
内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。
不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。
第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。
七、 违约责任
如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。
如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。
八、 法律适用与争议解决
本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。
因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。
九、 其他
本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。
本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。
我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。