ChatGPTへの入力、学習利用を見る規約の3項目
画像出典: 写真: Jernej Furman from Slovenia(CC BY 2.0 / Wikimedia Commons)
「入力が学習に使われる」とは、あなたの文章がそのまま保存・公開されることではなく、モデルの重みを更新する訓練データの候補になることを指します。確認すべきは「学習利用の初期設定」「オプトアウトの場所」「保存期間」の3項目で、個人向けチャット画面は学習利用がオンのまま始まる例が多く、API・法人契約は初期状態で学習に使わない設計が一般的です。オプトアウトは将来の会話にのみ効き、すでに学習へ使われたデータは取り消せません。
「学習に使われる」という言葉が何を指しているのかが曖昧なままだと、不安だけが残ります。保存されることと、学習に使われることと、他の人の画面に出ることは、実は全部別の話です。
ここを分けて理解できると、規約のどこを見ればいいかが決まります。全文を読む必要はありません。見るのは3項目だけです。
「学習に使われる」とは、具体的に何が起きること?
まず前提をそろえます。あなたが送った文章は、返事を作るためにサーバーへ届き、そこで一度保存されます。ここまではメールでもクラウドストレージでも同じで、AI特有の話ではありません。
「学習に使われる」というのは、その保存された会話が、次のモデルを訓練するための材料の候補になる、という意味です。訓練とは、大量の文章を読ませてモデル内部の膨大な数値(重み)を少しずつ調整していく作業のことです。あなたの1通のメールは、その調整にごくわずかな影響を与える1粒として溶け込みます。
だから、入力した文章がそのままの形でどこかに保管されて他人に検索される、という絵とは違います。近いのは、料理に使われた材料です。スープに入れた塩は、スープの味を確かに変えますが、あとから塩の粒だけを取り出すことはできません。
溶けて見えなくなるのは、あくまで「よくある普通の文章」の場合です。何度も繰り返し出てくる文字列や、他に類を見ない特徴的な並びは、モデルがそのまま覚えてしまうことがあります。これは記憶(memorization)と呼ばれ、研究の世界では以前から知られている現象です。
顧客の氏名と電話番号がセットで並んだリスト、社内でしか使わない固有の型番、未公開のソースコード。こうしたものは「よくある文章」ではないぶん、モデルにとって特徴が立ちます。心配すべきなのは日常の相談文ではなく、他に同じものが存在しない情報のほうです。
規約で見るべき3項目はどこ?
各社の利用規約とプライバシーポリシーは長いですが、この不安に答える箇所は限られています。次の3つを順に探してください。
- 学習利用の初期設定:自分が使っているプランで、初期状態から学習に使われるのか
- オプトアウトの場所と効き方:どの画面で止められて、いつからの会話に効くのか
- 保存期間:学習に使わない場合でも、会話はどれだけ残るのか
1. 学習利用の初期設定は、プランで大きく変わる
ここが一番の分かれ目です。同じ会社の同じモデルでも、どの入り口から使っているかで初期設定が逆になります。
| 使い方 | 学習利用の初期状態(一般的な傾向) |
|---|---|
| 個人向けチャット画面(無料・個人有料) | オンで始まることが多く、自分で止める操作が必要 |
| API経由での利用 | 初期状態で学習に使わない設計が一般的 |
| 法人・組織契約(Team/Enterprise等) | 契約条件として学習利用を行わないとされることが多い |
OpenAI、Google、Microsoftの公表情報をもとに作成
この傾向は、各社の実際の記述にも表れています。OpenAIの場合、個人向けのChatGPTでは「Improve the model for everyone(みんなのためにモデルを改善する)」という設定があり、これが初期状態でオンになっています。一方でChatGPT Team、Enterprise、Edu、およびAPIプラットフォームは、初期状態でOpenAIのモデル学習には使われないとされています。
Googleの生成AIサービスGeminiでは、学習利用が「Gemini Apps Activity」という履歴設定に紐づいており、これがオンだとプロンプトと応答が学習に利用され得ます。Microsoftの法人向けCopilotは、Enterprise Data Protection(EDP、組織データを既存のMicrosoft 365と同等の契約条件で保護する仕組み)の対象となり、学習には使用されないと明記されています。
初期設定が分かれるのには理由があります。個人向けチャットは無料または安価で提供されており、利用者の会話が品質改善の資源になることが前提に置かれています。対して法人契約やAPIは、企業が自社データを預ける前提で結ばれるため、学習に使わないことが契約上の売り物になっているのです。払っている料金の性質が、初期設定の向きを決めていると考えると見通しがよくなります。
2. オプトアウトは「これから」にしか効かない
止め方そのものは難しくありません。ChatGPTなら「設定 > データコントロール > Improve the model for everyone」のトグルをオフにします。Geminiなら myactivity.google.com/product/gemini で「Keep Activity」をオフにし、既存の履歴も消したい場合は「Turn off and delete activity」を選びます。
- 自分のプランを確認する個人向けか、組織アカウントか。会社から配られたアカウントなら管理者側の設定が優先されます。
- 設定画面のデータ関連項目を開く「データコントロール」「アクティビティ」など、プライバシーではなくデータの見出しの下にあることが多いです。
- 学習利用のトグルをオフにする履歴の保存とは別項目になっている場合があるので、両方を見ます。
- 反映のタイミングを理解するオフにした後の会話に適用されます。
OpenAIは、オプトアウトが将来の会話の学習利用を停止するものであり、過去の会話やすでに学習に使われたデータを撤回するものではないと説明しています。つまり、設定をオフにするのは「これ以上入れない」であって、「入れたものを取り出す」ではありません。すでに機密情報を入力してしまった場合、設定変更だけで無かったことにはできない、というのが正直なところです。
3. 学習に使われなくても、会話は一定期間残る
3つめの項目が見落とされがちです。学習利用をオフにしても、不正利用の監視や障害対応のために、会話は一定期間サーバーに保持されるのが普通です。Googleは、Keep Activityの設定に関わらずアカウントのチャットを最大72時間保持するとしています。
ここを分けて考えられると、判断が正確になります。「学習に使われない」と「どこにも残らない」は別のことです。本当に痕跡を残したくない情報なら、そもそも入力しないという選択しかありません。
会社によって書き方が違うとき、どう読む?
調べていくと、解説記事の説明と公式ヘルプの記述が食い違っている場面に出くわします。実際、Anthropicの生成AIサービスClaudeについては、消費者向けプランの初期設定をめぐって、外部の解説と公式ヘルプページの記述が一致しない状態が見られました。方針が途中で変更され、解説記事が古い時点の情報のまま残っている、という形はよく起こります。
ここでの原則はひとつです。各社の公式ヘルプページを、自分のアカウントの設定画面と突き合わせて確認する。設定画面に実際に表示されているトグルの状態が、あなたのアカウントにとっての事実です。第三者の解説は、どこを見ればいいかの地図として使い、最終確認には使わないでください。
もうひとつ、Claudeには会話をモデル改善に利用しない「シークレットチャット」機能が用意されています。このように、全体設定とは別に、会話ごとに学習対象から外す仕組みを持つサービスもあります。設定画面だけでなく、入力欄の周辺にそうした切り替えがないかも見ておくと選択肢が増えます。
結局、何を入れて何を入れないべき?
設定を整えたうえで、最後は自分の中に線を引く必要があります。設定はいつ変わるかわからず、操作ミスもあるからです。基準は「学習されるかどうか」ではなく、その情報が自分の管理下を離れて第三者のサーバーに渡ってよいかで考えると、サービスが変わっても使い回せます。
- 顧客・取引先の氏名、連絡先、契約内容
- 社外秘の資料、未公開の企画・数値
- パスワード、APIキー、アクセストークン
- 自分以外の個人の健康・家庭に関する情報
- 公開されていないソースコード
とはいえ、実務でこれを完全に避けると使えなくなってしまう場面もあります。そのときは情報を抽象化してから渡すのが現実的です。会社名を「A社」、金額を「約X万円」、氏名を役職名に置き換えても、文章の添削や構成の相談はほぼ同じ品質で成立します。AIに必要なのは文章の構造であって、固有名詞ではないことがほとんどです。
業務として本格的に使うなら、個人アカウントではなく組織契約やAPI経由に移すことも検討する価値があります。初期状態で学習に使わない設計になっているぶん、設定の当たり外れに依存せずに済みます。個人の設定に頼る運用は、担当者が変わった瞬間に崩れるからです。
今日やっておくこと
難しい話をしてきましたが、行動は短く済みます。使っているAIサービスの設定画面を開いて、学習利用のトグルの状態を自分の目で見る。それだけで、「たぶん学習されている気がする」という宙ぶらりんの不安は消えます。
そのうえで、入力を避けるものの線を自分の中に一本引いておく。設定は変わることがありますが、自分の判断基準は変わりません。守ってくれるのは最終的にそちらです。
知ってから決めればいい話です。まずは設定画面を開くところから、のぞいてみてください。
よくある質問
ChatGPTに入力した内容は他の人に見られますか?
入力した文章がそのままの形で他のユーザーに表示される仕組みにはなっていません。学習に使われる場合も、会話はモデルの内部パラメータを調整する材料として溶け込む形で扱われます。ただし、他に類を見ない特徴的な文字列はモデルが記憶してしまう可能性が指摘されているため、顧客情報や社外秘データの入力は避けるのが安全です。
学習利用をオフにすると、過去に入力した内容も学習から除外されますか?
されません。OpenAIは、オプトアウトが将来の会話の学習利用を停止するものであり、過去の会話やすでに学習に使われたデータを撤回するものではないと説明しています。設定変更は「これ以上使わせない」ための操作であり、遡って取り消す手段ではありません。
API経由で使えば学習されませんか?
OpenAI、Anthropic、Microsoftいずれも、API経由の利用や法人・組織契約は初期状態でモデル学習に使用しないという方針が共通して確認できます。個人向けチャット画面は学習利用がオンで始まる例が多く、ここが最大の違いです。ただし方針は変更されることがあるため、契約前に各社の公式ヘルプページで最新の記述を確認してください。
学習に使われなければ、会話はサーバーに残りませんか?
残ります。学習利用の停止と、データの保存期間は別の項目です。Googleは、Gemini Apps Activityの設定に関わらずアカウントのチャットを最大72時間保持するとしています。多くのサービスが不正利用の監視や障害対応のために一定期間の保持を行っているため、痕跡を残したくない情報は入力しないことが唯一の対策になります。
※記事で使用した内容・数値は変更される場合があります。最新情報は公式サイトをご確認ください。