微信扫码
添加专属顾问
我要投稿
上周给大家分享过Jina AI最新的研究,late chunking, 通过将chunk分块后置到emebedding之后,来达到提升召回的效果。 今天给大家分享一个新的策略,称为DS-RAG。
一个不好的分块,会带来很多的问题,比如说以下几点:
等等。。。
解决方案有2种:
前者添加上下文头的目的是给文档块添加更多的上下文信息,这些上下文头会随着块一级被向量模型编码。下图是个例子:
测试添加块头能明显的提高相关的文档块与query的相关性。
同样,针对这个query,如果我们计算与这个文档所有块的相似度。可以绘制出下面的点图,围绕在chunkid_400附近存在一些高相似度的文档块。当一个块附近的文档块都与query相近时,我们可以把这些块合并成一个段(segments)。如果把这些段合并作为整体送入LLM,可能可以获得更好的效果。那如何识别这些段的存在呢?因为已经计算了query与块的相关性,所以直接减去一个常数超参,让相关的块的score仍为正数,不相关的为负数。这个超参越大,段越小,反之,得到的段越大。
通过这种方法可以得到一个大段。
这个策略的一个优点是,当部分被排序模型认为不相关的块,但夹在高度相关的块之间,通常与query也是相关的。
因此,除了为LLM提供更完整的上下文之外,这种动态构建相关文本片段的方法还使我们的检索系统对排序模型所犯的错误不太敏感。
项目代码:https://github.com/D-Star-AI/dsRAG/tree/main
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-06-27
腾讯混元发布 PhoneBuddy:4B 开源手机 Agent,在 AndroidWorld 上超越 Gemini3.1 Pro
2026-06-27
本地部署 Gemma 4 26B QAT 实践记录
2026-06-26
Higress v2.2.3 发布:AI Gateway 能力增强,Gateway API 及其推理扩展持续打磨
2026-06-26
我把自己的知识库系统开源了
2026-06-26
近 8 千 Star!一次性干翻整本 PDF,百度这个 OCR 让文档解析彻底变了天
2026-06-25
谷歌开源 agents-cli:让 AI 助手帮你完成企业级 Agent 从搭建到部署全流程!
2026-06-25
官宣|我们推出了开源版Claude Tag,以及它背后记忆与工具引擎 MFS
2026-06-24
Nathan Lambert:GLM-5.2是开源Agent重大突破,连锁反应将渗透进更广泛的经济体
2026-03-30
2026-04-09
2026-04-03
2026-04-01
2026-03-31
2026-03-30
2026-04-18
2026-04-18
2026-03-31
2026-04-02
2026-06-16
2026-05-30
2026-05-16
2026-04-22
2026-04-21
2026-04-15
2026-04-09
2026-04-01