RAG 回答带引用,为什么仍然可能答错?
摘要:RAG 会先检索资料,再让模型根据资料回答。页面出现引用链接,只能证明系统附带了来源,不能自动证明来源与结论完全对应。 第一种错误是检索错了。关键词相似的旧文档或其他产品资料被召回,模型可能基于错误上下文形成顺畅答案。 第二种是引用对、解释错。原文说“部分版本支持”,回答却省略条件,写成“全部支持”。审核需要核对引用是否真正支撑具体主张。 第三种是资料冲突。不同版本同时进入索引,模型可能混合两个结...
RAG 会先检索资料,再让模型根据资料回答。页面出现引用链接,只能证明系统附带了来源,不能自动证明来源与结论完全对应。
第一种错误是检索错了。关键词相似的旧文档或其他产品资料被召回,模型可能基于错误上下文形成顺畅答案。
第二种是引用对、解释错。原文说“部分版本支持”,回答却省略条件,写成“全部支持”。审核需要核对引用是否真正支撑具体主张。
第三种是资料冲突。不同版本同时进入索引,模型可能混合两个结论。知识库应记录生效时间和权威级别,而不是让模型自行猜测。
第四种是引用装饰。链接与主题相关,却没有包含回答中的数字或结论。评测时应逐条检查主张与证据,不只统计是否出现 URL。
可靠的 RAG 需要检索评测、回答评测和权限测试三条线。资料不足时允许拒答,冲突时展示差异,高影响问题转人工。引用提高了可复核性,但真正的可靠性来自正确资料、准确解释和持续验收。
本文在提纲整理和初稿撰写中使用了AI辅助,发布前已人工复核事实与表达。