Hi LLMllm.hi.cn

模型列出不存在的资料时,发布前应如何处理?

不要直接发布。遇到模型列出的资料无法追溯时,先把资料名称、引文和链接全部视为待核验线索,逐项寻找原始页面或正式记录;确认资料确实存在、且原文支持正文,才保留相应内容。检索不到并不等于已经证明资料不存在,但应按未核实处理,删除相关断言或只写已确认的部分。

OpenAI 帮助中心提醒,ChatGPT 有时会生成错误或误导性内容,重要信息需要从可靠来源核实;它也指出,模型可能给出编造的引文、研究、引用,或参考不存在的来源。因此,模型给出的资料名只能作为核查起点,不能单独当作证据。

先分清“资料存在”和“资料支持什么”

资料能够找到,不代表它支持模型给出的那句话;资料与主题相关,也不等于它证明了正文结论。应分别核对来源是否真实存在,以及原文是否支持具体表述,不能因为标题看起来合理、作者名字熟悉或链接格式正确,就跳过后续检查。

发布前可按这个顺序处理

  1. 拆出需要核验的表述。 把正文中的事实性判断、具体引文和结论分别列出,并记录模型声称的来源,不要先根据语气判断真假。

  2. 逐项追溯来源。 优先查找发布机构的原始页面、正式出版物记录或图书馆目录。只核对模型实际提供的线索,不要自行补写作者、年份、题名或链接。

  3. 核对原文内容。 确认资料确实存在,并检查对应段落是否真的支持正文说法。引用还要核对具体措辞、上下文、对象和适用范围;主题相近,不等于结论相同。

  4. 交叉核对重要信息。 对关键事实,再寻找可靠来源进行交叉核对。单一来源无法确认时,不要把模型的概括升级成确定结论。

  5. 按核对结果处理。

核对结果 发布前处理
原始资料可追溯,且支持该说法 保留出处,并按原文范围准确表述
资料存在,但不支持或只支持部分说法 删除不当归属,缩小或改写结论
只能找到转述、摘要或片段 继续追溯;完成前不把它当作已核实证据
未查到可核验的原始资料 不发布该出处及其引文,不用确定性语气改写

哪些内容仍需自己确认

即使资料真实存在,也要确认版本、日期、适用范围、定义和上下文。涉及政策、费用、期限、资格或合同等内容时,不能用模型的概括代替适用的正式材料;正式材料没有写明的内容,不要自行补齐。若关键环节无法确认,就缩小结论范围,只发布已经核实的部分。

最简判断标准是:出处可追溯、原文可核对、正文没有超出原文支持范围。任何一项不满足,就不要把它写成确定事实。

资料来源