Hi LLMllm.hi.cn

内部资料进入模型前,敏感信息应先过哪道检查?

先做“敏感信息与使用边界检查”:确认准备发送的内容是否包含不宜外传的信息,并只保留完成任务所必需的部分。随后再核对模型的数据控制设置。OpenAI 说明,数据控制功能可让用户选择是否将对话用于训练 OpenAI 模型,但这不能替代上传前的信息检查。

第一道检查:判断内容能不能发

发送文件或粘贴文字前,可逐项确认:

  • 是否包含能识别个人或组织的信息、访问凭据、业务记录或其他受限制内容;
  • 这些信息是否确实为完成任务所必需,能否用占位符、样例或概括信息替代;
  • 内容是否受到合同、单位制度、保密义务或第三方权限的限制。

最后一项需要使用者根据实际适用的约定自行判断,不能仅凭模型的隐私设置或生成结果作出结论。

再核对数据控制,但不要把它当成安全证明

OpenAI 帮助中心说明,数据控制功能允许用户选择是否将对话用于训练 OpenAI 模型。这项功能管理的是对话的训练用途,不负责判断某份内容是否敏感、是否获准外传,也不应被理解为上传前检查已经通过。

如果使用其他服务,应查看该服务自己的官方说明,不能直接套用 OpenAI 的设置或政策。

模型给出答案后,还要核对内容

OpenAI 同时提醒,ChatGPT 有时会生成错误或误导性内容,重要信息需要核实。模型完成整理、摘要或判断后,应把关键结论与原始材料及可靠来源逐项对照,不能把表达流畅直接当作内容准确。

仍需自己确认的结论

在把结果用于实际工作前,仍要确认三件事:内容是否适合外传,所选服务的数据控制是否符合当前需要,以及模型生成的重要信息是否已经过来源核对。

简化的检查顺序是:先查敏感信息和外传边界,再查数据控制,最后查模型输出。前一步不能被后一步替代。

资料来源