ChatGPTのデータコントロールは、会話や操作内容をモデル改善に使うかどうかをユーザーが選べるようにするものです。 この設定をオフにすることは重要な保護策になり得ます。ただし、それだけで機密資料や個人情報の入力が自動的に許可されるわけではありません。学習利用の有無は、プライバシーとコンプライアンスの論点の一部にすぎないからです。
Temporary Chat(一時チャット)も万能ではありません。OpenAIは一時チャットについて、履歴に保存されず、Memoryに使われず、学習にも使われず、30日後に削除されると説明しています。一方で、不正利用の監視のために確認される場合があるともしています。 そのため、秘密の業務資料、本物の顧客データ、健康情報を入れてよいという「免罪符」にはなりません。
OpenAIはConsumer向けの利用と、業務向け製品の扱いを分けて説明しています。Businessデータとは、ChatGPT Business、ChatGPT Enterprise、ChatGPT for Healthcare、ChatGPT Edu、ChatGPT for Teachers、API Platformにおける入力と出力を指すとされています。
OpenAIは、これらのBusinessデータを標準では学習に使わないと説明しています。 また、ChatGPT Business、ChatGPT Enterprise、APIについては、GDPRなどのプライバシー要件への対応を支援するData Processing Addendum、つまりデータ処理に関する補遺契約を締結できるとしています。ChatGPT EduとChatGPT for Teachersについては、Student Data Privacy Agreementに基づいて処理すると説明しています。 さらにOpenAIは、Enterprise、Business、Edu、ChatGPT for Healthcare、API向けに、Businessデータのプライバシー、セキュリティ、コンプライアンス、データ保持ポリシーに関する情報を提供しています。
ただし、BusinessやEnterpriseを使えば何でも入力してよい、という意味ではありません。企業や組織は、目的、データの種類、アクセス権限、保存期間、社内規程、顧客との契約、業界ごとの規制を確認する必要があります。
実データをAIツールに入力・アップロードする前に、少なくとも次の点を確認してください。
これらが明確でない場合は、実データをそのまま使わず、プレースホルダー、匿名化した抜粋、合成データに置き換えるのが安全です。
安全なプロンプトの基本は、目的に必要な情報だけを入れることです。回答に不要なら、氏名、メールアドレス、電話番号、住所、顧客番号、患者番号、契約番号などの識別子は削除します。
顧客対応の相談
実際の問い合わせ全文を、氏名・顧客番号・連絡先付きで貼るのは避けます。代わりに、[顧客]、[顧客番号]、[日付] のようなプレースホルダーを使います。
表や一覧データ
顧客リストや従業員リストを丸ごとアップロードしないでください。直接識別子を削り、分析に必要な列だけに絞ります。
コード
APIキー、トークン、秘密鍵、パスワード、本番環境に近い接続情報をプロンプトに入れないでください。必要なコード片だけを示し、設定値はプレースホルダーに置き換えます。
契約書や財務情報
確認したいのが条項、表現、構成だけなら、全文ではなく匿名化した抜粋を使います。未公開の財務数値や秘密保持対象の資料は、承認された環境で扱うべきです。
ダミーデータでは足りない場面もあります。その場合でも、順番は保守的に考えます。
ChatGPTを使ってよいかどうかは、「全部OK」でも「全部NG」でもありません。Consumer向けの文脈では、プロンプトやアップロードに個人データが含まれ得るUser Contentとして扱われる可能性があります。 データコントロールやTemporary Chatは、会話がモデル改善、履歴、Memoryに使われるかどうかに関わります。Temporary Chatは30日後に削除されると説明されていますが、不正利用の監視のために確認される場合があります。
一方で、Business、Enterprise、Edu、Healthcare、APIについては、OpenAIが別のルールを説明しており、Businessデータを標準では学習に使わないとしています。
迷ったときの実務ルールは明確です。貼らない。まず匿名化する。プレースホルダーに置き換える。必要なら、承認済みのBusiness、Enterprise、API環境で、設定と契約を確認してから使う。AIに聞く前のこのひと手間が、情報漏えいと後戻りできないトラブルを防ぎます。