我要投稿

为什么你的知识库回答不了"张三和B公司什么关系"

发布日期：2026-06-09 20:36:00 浏览次数： 1526

作者：瓶子酱随笔

微信搜一搜，关注“瓶子酱随笔”

最近因为工作经常接触 agent、知识库、RAG 这些词，每次遇到新概念都会去查一查，但一直没系统整理过。

今天想聊聊一个基础但重要的问题：AI 是怎么"长脑子"的？我们提问时，它是怎么检索信息的？

先说传统 RAG

RAG（Retrieval-Augmented Generation）是目前最主流的方案，原理不复杂，三步走：

• 切块：把文档切成几百字的小段

• 向量化：每段转成一串数字（向量）

• 检索：提问时把问题也转成向量，找到最相似的几段，交给大模型总结

这套方案用于处理结构化信息够用了。但如果你的知识库需要理解实体之间的关系，传统 RAG 就有点力不从心。

举个例子：

文档 A 写了"张三是 A 公司的法人"，文档 B 写了"A 公司全资控股 B 公司"。你问"张三和 B 公司有什么关系？"——传统 RAG 很难把这两块分散的文本拼起来回答。

再比如问"这份报告的三大核心风险是什么？"，如果风险分散在 10 个章节里，传统 RAG 只能召回含"风险"字眼的几页纸，给不出全局总结。

简单说就是：只见树木，不见森林。

再说 Graph RAG

Graph RAG 是微软力推的新一代方案，思路完全不同——它不把文档当孤立的文本块，而是当成一张关系网：

1. 实体与关系抽取：用大模型从文本中提炼出"人、事、物"和它们之间的关系

2. 构建图谱：把实体和关系连成知识图谱

3. 社区聚类（灵魂步骤）：把关系紧密的实体划分为"社区"，提前为每个社区生成全局摘要

4. 检索时：不只找具体实体，还能调用社区摘要来回答宏观问题

这样就能回答"这本小说讲了什么？""用户反馈最核心的三个抱怨是什么？"这类需要全局视角的问题，也能顺着图谱的线条找到 A → B → C 这样的隐藏关联。

那该选哪个？

成本差异很明显。

传统 RAG 的开销主要是向量数据库，门槛不高。Graph RAG 则需要：

• 大量 LLM 调用来抽取实体和关系（算力成本不低）

• 人工审核数据准确性

• 图数据库（如 Neo4j，社区版功能有限，商业版价格不便宜）

所以，简单结构化信息 → 传统 RAG 就够了。需要复杂关系检索、深度推理的话，可以在传统 RAG 基础上辅以 Graph RAG。

可以根据场景选方案，别为了高级上 Graph RAG。

大家如果有相关实践经验，欢迎评论区交流。

如果对你有帮助，点个在看 👇 让更多人看到

声明:本文为Canace 原创,不代表平台观点,未经许可禁止转载。

53AI，企业落地大模型首选服务商

产品：场景落地咨询+大模型应用平台+行业解决方案

承诺：免费POC验证，效果达标后再合作。零风险落地应用大模型，已交付160+中大型企业

相关资讯

2026-06-09

万字长文！千万级文档 RAG 知识库系统落地实践

2026-06-08

RAG不够用了？谷歌推出全新Agentic RAG框架

2026-06-06

RAG检索：注定下沉为检索基础设施

2026-06-02

设计生产级 RAG 架构

2026-06-02

万字深度|做了8年向量数据库后，我们决定为Milvus重构AI时代的存储引擎

2026-06-02

PDF2X：教材等高知识密度文档的解析与抽取实战

2026-05-28

ragflow v0.25.6 发布：Browser 自主浏览、RAPTOR 升级、Agent 体验增强与大量稳定性修复全解析

2026-05-27

从文档到智能问答：知识库构建的九步流程

联系获取

160+中大型企业正在使用53AI

立即咨询预约演示

把握AI发展的机遇，共同探索、共同进步

2025-01-22

如何打造基于GenAI的员工服务机器人

2025-01-22

热点资讯

知识基座：让“AI 越用越懂业务”的团队经验实践【天猫AI Coding实践系列】

2026-03-23

全网爆火的大模型AI知识库，保姆级教程来了

2026-04-06

从RAG到GraphRAG：货拉拉元数据检索应用实践

2026-03-18

为什么总感觉 Claude Code 比 Cursor 聪明？真正的原因根本不是模型能力！

2026-03-20

Karpathy的LLM Wiki + 3.5 万Star的Graphify：企业级 RAG 缺的真是知识图谱？

2026-04-27

OpenDataLoader：PDF文档提取的一站式方案

2026-03-31

RAG进化了，深扒Claude Code源码中RAG高级技巧

2026-04-02

面向手机Agent的记忆系统工程:OPPO的Agentic-RAG实战与演进

2026-03-21

企业AI落地三重门，用友如何破局？

2026-03-17

2026 年做搜索就是做 Agent Memory

2026-04-23

大家都在问

AIOps探索：给不能联网的客户做一个AI运维助手到底有多难？

2026-05-20

有多少人把Agent与RAG的检索策略，简化成了 if-else？

2026-05-18

到底是谁会相信RAG已死啊？

2026-05-11

1G内存检索2500万向量，Milvus中如何用FLAT在强标量过滤场景搞定毫秒响应？

2026-05-07

多Agent场景，子agent 之间数据读写不同步，如何解决？

2026-05-06

Karpathy的LLM Wiki + 3.5 万Star的Graphify：企业级 RAG 缺的真是知识图谱？

2026-04-27

多轮对话时，RAG反复做重复召回，模型层与Milvus层分别如何解决？

2026-04-21

企业AI落地三重门，用友如何破局？

2026-03-17

热门标签

内容创作大模型技术个人提效 langchain llamaindex 多模态技术 RAG技术智能客服知识图谱模型微调 RAGFlow coze Dify Fastgpt Bisheng Qanything AI+汽车 AI+金融 AI+工业 AI+培训 AI+SaaS Skill 提示词技巧 AI+电商 AI面试数字员工 ChatBI AI知识库开源大模型智能营销智能硬件 FDE AI+医疗 MaxKB Palantir Glean Openclaw

为什么你的知识库回答不了&quot;张三和B公司什么关系&quot;

先说传统 RAG

再说 Graph RAG

那该选哪个？

为什么你的知识库回答不了"张三和B公司什么关系"