返回知识库

AI 与提示 · 知识与检索

依据校验Grounding

依据校验在生成之后逐条核验:回答里的每个关键断言要能回链到上下文证据片段。命中=可溯源,未命中 / 冲突=无依据,无依据的句子不能当事实输出。

把客服回答里的每句事实落到政策原文

用户问数字商品退款,AI 草稿混进了一句政策没写的到账承诺。先核对整份回答,再把越界句在原回答气泡里安全改写:事实保留行号,未知项坦白缺口。

一张真实客服回答,旁边就是它声称依据的退款政策。核对不是看整段“像不像真的”,而是让回答里的每个具体断言落到一行看得见的原文。

客服工单 #4821数字商品退款等待来源核对
内部知识库退款政策版本 2026.08
  1. L12

    退款申请须在购买后 7 天内提交。

  2. L18

    已拆封的数字商品不支持退款。

  3. L22

    VIP 会员享有专属客服通道,不改变退款条件。

来源边界政策没有写“到账时效”。

AI 客服草稿给 VIP 用户的回复

请在购买后 7 天内提交退款申请。

如果数字商品已经拆封,就不支持退款。

VIP 退款会在 2 小时内到账。

待核对 3 条具体断言流畅不等于有依据

下一步:核对来源默认回答里有三条具体断言。先核对来源,看看哪些句子真正落到了政策原文。

知识点:可溯源、无依据、冲突三态

把面板里看到的现象命名清楚——grounding 把每条断言映射到三态之一,并决定能不能输出。

  • 断言是核验的最小单位回答要先拆成「可以单独验证」的陈述(每条带一个角标),再逐条核验。整段「看起来通顺」不等于有依据。
  • 可溯源 = 命中片段断言能在上下文里找到支持它的片段,并保留 source id、标题和定位(如 policy-17 §2)。可溯源的句子可以输出,并附引用。
  • 无依据 = 没有片段支持上下文里找不到任何支持(如「VIP 退款 2 小时到账」),就不能把它当成已知事实。应收回、标记不确定或转人工补证。
  • 冲突 = 与片段直接矛盾断言和上下文相反(如「已拆封也能退」撞上「已拆封不支持」)。同样不能当事实输出。
  • 事后核验 ≠ 生成前检索rag / embedding / reranking 在生成之前找片段;grounding 在生成之后检查回答是否忠于已检索到的片段,是 hallucination 的兜底。

什么时候用,怎么用

凡是要把「忠于资料」当硬约束的回答都该加 grounding;判断信号和最短路径如下。

适合用

涉及政策、价格、权限、合规、医疗、法律的问答;客服知识库;任何「编一句就出事」的场景。检索到的片段就是核验依据。

不适合

纯推理 / 计算、开放闲聊、创意写作;这些场景没有「上下文片段」可回链,强行走流程只会得到空判据。降级为不强制引用即可。

最短路径

检索片段 → 生成带角标的回答 → 逐条把断言匹配到片段(记 source id + 定位)→ 三态判定 → 无依据 / 冲突的拒答或标推测,可溯源的附引用输出。线上留存断言、来源版本、判定结果和人工反馈。

正反例:同一份退款回答,只改越界句的处置

两份回复的政策来源完全相同,差别只在“2 小时到账”没有出处后是否还继续承诺。

正例事实附行号,未知项转人工

“7 天内申请”“已拆封不支持”分别附 L12、L18;到账时效改成“政策未说明,我可以转人工确认”。用户知道哪些已证实、哪些仍待补证。

反例发现缺口,仍承诺 2 小时到账

政策同样只写申请期限、拆封条件和客服通道,却把“VIP 退款 2 小时到账”保留成肯定句。用户据此预期资金到账,最后只能投诉。

快速自测

核验发现回答里有 1 条断言找不到任何上下文片段支持,最稳妥的处置是?

继续查证

术语的技术定义和行为以这些一手或权威资料为准。

下一步学

和本知识点经常一起出现的概念。