免费POC, 零成本试错
FDE知识库

FDE知识库

学习大模型的前沿技术与行业落地应用


收藏

中小企业AI破局:RAG 部署从 “能用” 到 “能用好” 的 10 条经验

发布日期:2025-08-01 09:04:31 浏览次数: 2248
作者:吕小鸣Developer

微信搜一搜,关注“吕小鸣Developer”

推荐语

中小企业如何突破AI应用瓶颈?Contextual AI CEO分享RAG部署十大实战经验,助你从"能用"到"能用好"。

核心内容:
1. 企业AI应用面临的"上下文割裂"核心难题
2. RAG系统在财富500强企业的成功部署案例
3. 从系统思维到生产就绪的10条关键经验总结

杨芳贤
53AI创始人/腾讯云(TVP)最具价值专家

本文源自 Contextual AI 首席执行官和联合创始人 Douwe Kiela 近日发表了 RAG Agent 经验的演讲整理而来,主要介绍的当下中小型企业利用AI提效的困境以及如何破局,聚焦内部知识库RAG这一核心概念(如果不了解RAG,可以参考一文了解大模型应用基本概念),非常有参考价值,希望能给读者启发!

image.png

尽管人工智能体前景广阔,但企业在试点阶段后往往难以实现真正的价值。“context paradox”(“上下文割裂难题”),即人工智能虽擅长复杂任务,却难以理解企业特定上下文场景,是一大障碍。本文基于[情境人工智能]首席执行官杜威·基拉(Douwe Kiela)的见解,专为所有在生产环境中部署检索增强生成(RAG)系统的人员而撰写。

文中将分享为财富500强企业扩展企业级人工智能时总结的十条关键经验,重点涵盖系统思维、专业化和生产就绪性等方面。

我是杜威·基拉,[情境人工智能]的首席执行官。接下来,我将深入探讨生产环境中的RAG,特别是RAG智能体,并分享我在人工智能研究和领导企业级人工智能公司过程中积累的宝贵经验。

最新一代大语言模型(LLMs)展现出了强大的推理能力。然而,要在企业环境中充分发挥其真正价值,就需要将这些智能体能力应用于“合适的”企业数据。在为人工智能智能体兴奋不已时,我们务必牢记那句永恒的格言:

“输入垃圾,输出垃圾”

只有正确设置上下文context,语言模型才能有效运行。

企业级人工智能的机遇与挑战

image.png

企业级人工智能带来了巨大的机遇,麦肯锡估计其可为全球经济增加44万亿美元的潜在价值。人人都渴望在这一领域分一杯羹,但也遭遇了不少挫折。许多人工智能副总裁面临着项目投资回报率(ROI)的巨大压力。《福布斯》的一项研究指出,只有四分之一的企业真正从人工智能中获益。

人工智能中的上下文割裂问题

为何会如此艰难呢?这类似于机器人领域的莫拉维克悖论:人类轻松完成的任务(如吸尘)对机器人来说却困难重重,而复杂任务(如下棋)对它们来说反而容易。

同样,企业级人工智能面临着“context paradox”。大语言模型在编码或解决数学问题等任务上表现出色,常常超越人类能力。但在将信息置于正确context方面,它们却困难重重。人类,尤其是专家,凭借多年的专业知识和直觉,能轻松做到这一点。

这一悖论是实现人工智能投资回报率的关键所在。当前的人工智能常通过通用助手来提供便利,提高效率。但企业追求的是“差异化价值”和业务转型。要实现更高价值,就需要更好地处理企业特定上下文场景;所需价值越高,对的要求就越高。

基于这一认识,[情境人工智能]于两年前成立。以下是大规模部署企业级RAG系统时总结的经验,重点是为财富500强企业构建强大的系统:

生产级RAG智能体十大实战经验

一图总结

image.png

1. 着眼系统,而非仅关注模型

语言模型令人印象深刻,但在企业级人工智能中,尤其是涉及检索增强生成(RAG)时,它们通常仅占整个系统的20%。我和我的团队最初在[Facebook人工智能研究]开创了RAG,它是使生成式人工智能与企业数据协同工作的标准方法。 人们常常将注意力完全集中在新的大语言模型上,而忽略了真正解决问题的周边系统。一个优秀RAG流程中的普通模型,可能比一个糟糕流程中的出色模型表现更好。应关注整个系统,模型只是其中一个组件。

2. 专业专注,积累专长

企业的专业知识是最宝贵的资产,目标是挖掘企业的知识。通用助手无法与企业内部的深厚专业知识相媲美。专业化是有效利用这些知识的关键。在[情境人工智能],我们倡导“专业优于通用人工智能”。虽然通用人工智能(AGI)有其用武之地,但解决复杂的特定领域问题需要专业化才能取得更好的效果。在通用人工智能热潮中,这看似有悖常理,但专业化能让解决实际业务问题变得更加容易。

3. 数据是大规模竞争壁垒

随着时间的推移,员工流动,数据定义了一家公司。这些数据代表了公司的长期形象和竞争优势。常见的误解是,人工智能使用数据前必须完美清理。真正的挑战和机遇在于,让人工智能在大规模“嘈杂数据”上有效运行。 做到这一点就能释放差异化价值,构建竞争壁垒,因为独特的数据定义了你的公司。

4. 立足生产设计,而非仅着眼试点

一个残酷的现实是,构建试点RAG系统相对容易。一个框架搭配几份文档的演示,往往能从小范围人群中获得积极反馈。但向“生产环境”的跨越是巨大的:

  • 文档规模从几十份扩展到数百万份。
  • 支持数千名用户。
  • 处理众多不同的用例。
  • 满足严格的安全和合规要求。

现有的开源工具在这种规模下往往力不从心。试点和生产之间的差距很大。从一开始就按照生产要求进行设计,以避免代价高昂的错误。

5. 速度迭代优先,而非追求完美

在生产部署中,速度往往比完美更重要。尽早将RAG智能体推向真实用户,即使它只是最低限度可用。收集反馈并迭代(“爬坡”),使其达到“足够好”的状态。 过度追求完美会让从试点到生产的过渡变得更加艰难。基于真实用户反馈进行迭代,是企业级人工智能成功部署的关键。

6. 聚焦工程价值,而非琐碎事务

为实现速度和迭代,要确保工程师专注于创造商业价值和差异化,而非琐碎任务。工程师很容易陷入优化分块策略或完善提示语的工作中,而这些任务本应由强大的平台抽象处理。 让工程师从这些工作中解脱出来,专注于对竞争力真正重要的高影响力工作。

7. 让人工智能易于使用和集成

生产环境中有生成式人工智能并不意味着会被采用。如果为降低风险使系统变得不实用,或者用户不知道如何有效使用,系统往往会被闲置。让人工智能易于使用至关重要。 这不仅要让人工智能与企业数据协同工作,还要将其无缝集成到现有用户工作流程中。更紧密的工作流程集成能显著提高系统成功采用的可能性。

8. 打造“惊艳”时刻

推动系统使用需要用户粘性,而这通常源于用户瞬间感受到工具价值的“惊艳”时刻。设计入职流程和初始用户体验,让这个时刻尽快到来。 例如,在高通公司,我们的系统为全球数千名工程师提供支持,一名用户在一份尘封七年的文档中找到答案,瞬间解决了长期困扰的问题,激动不已。这些“小成就”是推动系统采用的强大动力。

9. 关注可观测性,而非仅追求准确性

准确性固然重要,但已成为基本要求。要达到100%的准确性往往是不可能的。企业越来越关注如何处理不可避免的误差(5 - 10%的差距)。 超过最低准确性阈值后,重点应转向通过可观测性管理误差。这需要强大的评估方法和审计跟踪,在受监管的行业中尤其如此。RAG系统中的 正确归因(将答案与源文档关联起来)至关重要。实施后处理检查,验证结论并确保回答有证据支持。

10. 志存高远

许多人工智能项目失败并非因为目标过高,而是过低。将生成式人工智能用于琐碎任务(如基本的人力资源查询),投资回报率极低,还往往沦为无人问津的噱头。 相反,设定雄心勃勃的目标,成功后能带来丰厚的投资回报。我们正处于变革时代,人工智能将重塑社会。从事人工智能工作的人有机会推动有意义的变革。不要满足于唾手可得的成果,要志存高远。

结论

context paradox仍是企业级人工智能的关键挑战。通过汲取这些经验——着眼系统、专业专注、立足生产设计、快速迭代、聚焦价值、确保易用性、打造“惊艳”时刻、关注可观测性和志存高远——你可以将这些挑战转化为重大机遇。

关于演讲者

杜威·基拉是[情境人工智能]的首席执行官兼联合创始人,也是斯坦福大学符号系统专业的兼职教授。此前,他是Hugging Face的研究主管,以及Meta基础人工智能研究(FAIR)团队的研究负责人,在那里他开创了检索增强生成(RAG)等多项关键人工智能突破。他在多模态、对齐和评估方面的工作为人工智能领域树立了新标杆。

53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询

扫码登录
登录即表示您同意《53AI网站服务协议》
服务协议

欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。

在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。

一、 定义

本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。

会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。

知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。

二、 账号注册与登录

登录方式:本网站支持以下登录方式,您可根据实际情况选择:

微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。

手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。

账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。

实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。

未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。

三、 服务内容与规范

知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。

服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。

禁止行为:您在使用服务时不得实施以下行为:

利用技术手段批量爬取、下载、转存知识库内容;

将知识库内容用于商业目的或未经授权地向第三方传播;

干扰本网站正常运行或侵犯其他用户合法权益;

发布违法违规信息或从事违反公序良俗的活动。

四、 知识产权声明

权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。

有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。

侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。

五、 个人信息保护

我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。

您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。

您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。

六、 免责声明

内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。

不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。

第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。

七、 违约责任

如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。

如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。

八、 法律适用与争议解决

本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。

因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。

九、 其他

本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。

本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。

我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。


已查阅