OpenAI 区分消费级使用和商业产品。OpenAI 将 ChatGPT Business、ChatGPT Enterprise、ChatGPT for Healthcare、ChatGPT Edu、ChatGPT for Teachers 以及 API Platform 的输入和输出称为 Business Data。
对于这些 Business Data,OpenAI 表示默认不会用于训练模型。 OpenAI 还称,对于 ChatGPT Business、ChatGPT Enterprise 和 API,可签署 Data Processing Addendum,即数据处理附录,以支持 GDPR 和其他隐私法规合规;对于 ChatGPT Edu 和 ChatGPT for Teachers,OpenAI 则提到 Student Data Privacy Agreement。
OpenAI 也提供了关于 Business Data Privacy、安全、合规和数据保留政策的信息,覆盖 Enterprise、Business、Edu、ChatGPT for Healthcare 和 API。
但这并不意味着只要是企业版,就什么数据都能放。企业仍需要确认处理目的、数据类别、权限设计、保存期限、内部制度、客户合同以及适用监管要求。
在把真实数据输入或上传到 AI 工具前,至少应确认:
如果这些问题答不清楚,就不要直接粘贴真实数据。优先使用占位符、匿名化片段或合成数据。
最安全的提示词,只包含完成任务真正需要的信息。姓名、邮箱、电话、地址、客户编号、患者编号、合同编号和其他识别符,如果不是回答所必需,就应删除或替换。
**客户案例:**不要复制完整工单和联系人信息。可以改成:[客户] 在 [日期] 遇到以下问题……客户编号用 [客户编号] 替代。
**表格数据:**不要上传完整客户名单或员工名单。删除直接识别符,只保留分析所需的列。
**代码:**不要把 API Key、Token、私钥证书、密码或生产环境凭据贴进提示词。只提供相关代码片段,并把配置值替换为占位符。
**合同和财务材料:**如果只是想检查某个条款、表达或模板,尽量使用脱敏后的片段,而不是上传整份文件。
有些场景下,虚构数据不够用。此时建议按更保守的顺序处理:
ChatGPT 不是简单的能用或不能用。关键在于数据是什么、工具版本是什么、设置和合同怎么写、组织内部是否批准。
在消费级场景中,OpenAI 说明提示词和上传内容可能包含个人数据,并可能作为 User Content 被收集。 数据控制和临时聊天会影响对话是否用于模型改进、是否出现在历史记录中、是否用于 Memories;OpenAI 说明临时聊天会在 30 天后删除,但仍可能用于滥用监测检查。
在 Business、Enterprise、Edu、Healthcare 和 API 场景中,OpenAI 列出单独规则,包括默认不使用 Business Data 训练模型。 如果你拿不准,就按保守原则处理:不要直接输入。先匿名化、用占位符,或改用经过批准的 Business、Enterprise 或 API 环境。