個人の方へ

個人のAIプライバシーは、アップロードする前から始まります。

AIプライバシーの失敗の多くは、静かに起こります。プロンプトに貼り付けたスキャン済みパスポート、公開ページに載せた子どもの写真、チャットボットに貼り付けた履歴書、要約のためにアップロードした非公開のメモなどです。このページは、何が問題ないか、何に墨消しが必要か、何をオフラインに留めるべきかを判断する手助けをします。

個人のリスクマップ

ほとんどの人は、まず法的理論を必要としているのではありません。必要なのはアップロードのルールです。

AIプライバシーは、しばしばありふれた瞬間に破綻します。あなたのフルアドレス入りの苦情文をチャットボットに書き直させたり、要約のために診断書のPDFをアップロードしたり、顧客のメールを貼り付けたり、子どもの写真をAI画像に変換したりする場面です。問われるのは「これはモデルを学習させるのか?」だけではありません。「そもそもこのデータを自分の手から離すべきか?」ということです。

  1. 緑:公開されている事実、一般的な例、すでに公開する予定だったテキスト、匿名化された下書き。
  2. 黄:履歴書、学校の課題、個人的な手紙、機微な背景のない写真、墨消し後の業務の下書き。
  3. 赤:ID、銀行の書類、診療記録、法的紛争、パスワード、子どもの非公開写真、顧客データ、そして共有の許可を得ていないあらゆるもの。

最良のブロックは、アップロードしないことです。

クローラーのルールは公開ページには役立ちます。しかし、あなたが自らツールに貼り付けた非公開のファイルは守りません。個人にとって、最も強力なコントロールは、何をローカルに留めるかを選ぶことです。

実践的な例

過度に共有せずにAIを使う方法。

履歴書・職務経歴書

電話番号、住所、生年月日、署名、推薦者を削除しましょう。プレースホルダーを使って、構成、トーン、言い回しを依頼してください。

診断書

ファイル全体を気軽にアップロードしないでください。平易な言葉での説明が必要なら、まず氏名、日付、クリニックの番号、識別可能な詳細を削除しましょう。

家族写真

提供者と製品の利用方法に納得していない限り、顔、子ども、家の内部、位置情報の多い写真をアップロードしないでください。

業務メール

顧客名、プロジェクト名、価格、社内の対立の詳細を置き換えましょう。可能な限り質問は一般的な形に保ってください。

個人データとは何か

個人データは、多くの人が予想する以上に多くの経路でAIシステムに届きます。

人々がAI学習を思い浮かべるとき、たいていは企業が意図的に書類をコピーする様子を想像します。しかし実際には、個人情報は多くの小さくありふれた経路を通じて同時に届く傾向があります。それらの経路を理解することは、実際にどこへ注意を向けるべきかを判断する助けになります。これは一切法的助言ではなく、各提供者の正確な挙動は時とともに変わるため、以下の説明は保証ではなく一般的な地図として扱ってください。

プロンプトとチャット履歴

チャットボットに入力するテキストは、追加の質問も含めてデータです。製品、アカウントの種類、設定によっては、その一部が保持されたり、品質のために人間によって確認されたり、モデルの改善に使われたりすることがあります。消費者向けの初期設定と、ビジネスやAPIの規約はしばしば異なります。お使いの特定のツールの現在の設定を確認してください。

アップロードと添付ファイル

添付するファイル、たとえばPDF、スプレッドシート、スクリーンショット、画像などは、提供者によって処理されます。一つのアップロードには、あなたが意図するよりはるかに多くの情報が含まれることがあり、メタデータ、隠れた列、コメント、写真に埋め込まれた位置情報タグなどが含まれます。

公開の投稿とページ

公開されているソーシャルプロフィール、フォーラムのコメント、レビュー、個人のウェブサイトなど、オープンなウェブ上で見えるものはすべてクローラーに取得され得ます。いったんコンテンツが公開されコピーされると、後で削除しても、他所にキャッシュされたすべてのコピーを確実に取り除くことはできません。

スクレイピングされたソーシャルプロフィール

ソーシャルプラットフォーム上の公開写真、プロフィール文、キャプション、つながりは、大規模に収集され得ます。プラットフォームの設定や規約はさまざまで、望まないスクレイピングへの対応も一貫していないため、「公開」設定は「収集される可能性がある」ものとして扱うのが最善です。

データブローカー

ブローカーは、公的記録、購入履歴、アプリの権限、その他の情報源からプロフィールを組み立て、それを転売します。このデータは下流のシステムに流れ込むことがあります。あなたは掲載されることを選んだわけではないことが多く、だからこそオプトアウトの要求は、部分的で時間がかかるとはいえ重要なのです。

第三者による共有

他人もあなたのデータを露出させることがあります。友人が写真にタグを付けたり、同僚があなたの住所を含むメールのやり取りを貼り付けたり、家族が共有の書類をアップロードしたりします。他人の行動を完全にコントロールすることはできませんが、自分が寄与する分を減らすことはできます。

役に立つ考え方。

あなたの露出は、おおよそ、あなたがアップロードするもの、あなたが公開するもの、他人があなたについて公開するものの合計です。最初のものには最も強いコントロールを持ち、二番目には意味のあるコントロールを持ち、三番目には部分的な影響力しか持ちません。その順番で労力を割きましょう。

露出を減らす

午後の時間で取り組める実践的なチェックリスト。

すべてを一度にやる必要はありません。以下のリストは義務ではなく、メニューとして扱ってください。各項目は露出を少し下げますが、どれもあなたを不可視にするものではなく、それはこの手法の失敗ではなく正直な限界です。

消費者向けの初期設定は異なる

消費者向けAIの学習の初期設定が提供者によってどう異なるか、そしてなぜ確認が必要か。

提供者は、消費者の入力がモデル改善に使われるかどうかについて異なる立場を取っており、それらの立場は方針の更新、製品の階層、地域によって変化します。以下の表は、遭遇し得る差異の種類を説明したものです。意図的に一般的なものであり、特定の提供者に関する現在の記述ではありません。これはまさに、大した予告もなく変わる類いの詳細なので、頼りにする前には必ず公式ドキュメントとアプリ内の設定で確認してください。

要素意味し得ること確認方法
アカウントの種類無料、個人の有料、チーム、企業向けのプランは、それぞれ異なるデータ規約に支配されることがあります。一般的なマーケティングページではなく、あなたの正確なプランに結びついた規約を読みましょう。
学習の初期設定一部の製品は初期設定で消費者の入力をモデル改善に使い、他は使わない、あるいはオプトインを必要とします。アプリ内のデータ管理またはプライバシーの設定を探しましょう。
オプトアウトの可否オプトアウトは存在するかもしれず、特定の地域に限られるかもしれず、過去に遡及しないかもしれません。その設定が過去のデータに影響するか、それとも今後の入力だけかを確認しましょう。
API対アプリAPIや開発者向けの規約は、消費者向けのチャットアプリとは異なる方法でデータを扱うことがよくあります。APIのデータ利用方針を、アプリの方針とは別に確認しましょう。
人による確認入力は、モデル学習とは別に、安全性や品質のために人によって確認されることがあります。提供者が確認、保持、スタッフのアクセスをどう説明しているかを読みましょう。

思い込まず、確認しましょう。

最も安全な前提は、保持されたくないものは、そもそも入力もアップロードもしないということです。設定は役立ちますが、それはあなたがツールを使う当日にそれをどれだけ理解しているかと同じ程度にしか信頼できません。

貼り付ける前に墨消しを

コンテンツの匿名化は、最も価値の高い唯一の習慣です。

墨消しは被害妄想の話ではなく、タスクに必要なものだけをツールに与えることです。うまく匿名化されたプロンプトは、たいてい同じくらい良い回答を生みます。文章を直すのにモデルがあなたの実際の住所を必要とすることはめったにないからです。以下は、応用できる単純なビフォー・アフターのパターンです。

Before:
"Rewrite this: Dear Dr. Meier, regarding my son Leon Muller,
patient ID 44-8821 at Zurich Clinic, appointment on 12 March..."

After:
"Rewrite this in a polite, formal tone: Dear [DOCTOR], regarding
my child [NAME], patient ID [ID] at [CLINIC], appointment on [DATE]..."

名前と関係

実名を[NAME]、または[CHILD]や[MANAGER]といった役割に置き換えましょう。あなたが欲しい言い回しの助けは、ほぼ確実に実際の名前に依存しません。

番号とID

口座番号、患者ID、電話番号、生年月日をプレースホルダーに置き換えましょう。計算のために正確な番号が重要なら、その部分はオフラインで行うことを検討してください。

ファイルと画像

署名、レターヘッド、参照番号を切り取りましょう。写真については、位置情報のメタデータを取り除き、住まいや職場が分かる背景を避けてください。

これらは匿名性を保証するものではありません。名前がなくても、文脈から個人が再識別されることがあるからです。とはいえ、最も明白で最も害の大きい識別子を取り除きはします。それは日常的な利用にとって、妥当で達成可能な目標です。

古いコンテンツとオプトアウト

すでに公開されているものを管理する:検索結果とデータブローカー。

将来の露出を減らすことは、過去を片付けることより簡単ですが、過去もなお重要です。この節では、不完全ではあっても現実的な、すでに出回っているものを減らす方法を扱います。部分的な結果、遅延、削除したコンテンツの時折の再出現を覚悟してください。それがこの作業の正直な性質だからです。

  1. 棚卸し:自分の名前、ユーザー名、メールアドレスを検索して、何が公開インデックスに載っているかを確認しましょう。住所、電話番号、機微な写真など、最もリスクの高い項目をまず書き留めてください。
  2. まずは発生源:可能な限り、検索結果を追うだけでなく、古いプロフィールやフォーラムの投稿など、元の発生源でコンテンツを削除または非公開にしましょう。
  3. 検索からの削除:主要な検索エンジンは、特定の機微な個人情報について削除依頼のツールを提供しています。これらは検索での表示に影響しますが、元となるページには影響せず、基準は地域によって異なります。
  4. ブローカーへのオプトアウト:大手のデータブローカーや人物検索サイトに削除の要求を提出しましょう。多くは時間をかけて繰り返しの要求を必要とし、一部は料金を取ったり、手続きをわざと面倒にしたりします。
  5. 維持:数か月ごとに再確認しましょう。オプトアウトは失効することがあり、プロフィールは新しい公開データから再構築され得ます。

重要な限界。

完璧な削除の努力をもってしても、あなたが行動する前にすでにキャッシュ、アーカイブ、スクレイピングされたコピーを呼び戻すことはできません。オプトアウトとrobots.txtは任意の慣習であり、全員ではないにせよ多くの主体が尊重します。これらは削除ではなく、被害の軽減として扱ってください。

俗説と現実

よくある誤解を解く。

自信ありげな助言はオンラインで素早く広まり、その一部は誤解を招きます。以下の対比は、いくつかのよくある俗説を、より慎重な読み方から切り分けます。いつも通り、これは法的助言ではなく教育的なガイダンスです。

俗説:投稿を削除すればどこからも消える

現実:削除は元のものを取り除けますが、コピーは以前に収集されたキャッシュ、アーカイブ、データセットに残ることがあります。それでも早く削除する方が遅いよりは良いです。コンテンツがコピーされ得た期間を短くするからです。

俗説:一つの設定ですべてのAI学習が止まる

現実:万能のスイッチはありません。アプリの設定、ウェブサイトのクローラー制御、ブローカーへのオプトアウトは、それぞれ別の層であり、どれも部分的です。露出を減らすには、それらのいくつかを組み合わせる必要があります。

俗説:非公開なら不可視である

現実:アカウントを非公開にすることは役立ちますが、スクリーンショット、再共有、過去に公開だった期間が痕跡を残すことがあります。「非公開」は露出をなくすものではなく、減らすものとして扱いましょう。

俗説:robots.txtは法的に学習を禁じる

現実:robots.txtは任意の技術的慣習です。あなたの希望を表明し、方針上の立場を裏付けることはできますが、それ自体は契約ではなく、遵守も普遍的ではありません。法的な問題は、管轄や具体的な事実に左右されます。

俗説:重要なのはあなたがアップロードするものだけ

現実:他人もあなたのデータを公開し得ます。自分のアップロードを管理することは必要ですが十分ではなく、だからこそ発生源からの削除やブローカーへのオプトアウトも計画に含まれるのです。

俗説:有料ツールは決してあなたを学習に使わない

現実:一部の有料やビジネスの階層は、より強固なデータ規約を提供しますが、これは自動的ではありません。支払えば初期設定が変わると思い込むのではなく、あなたの特定のプランの規約を確認しましょう。

関連する読み物

次のステップ。

ModelVersus modelversus.com

ワークフローを選ぶ前にAIモデルを比較しましょう。

ChatGPT Alternatives chatgpt-alternatives.com

一つのAI提供者では足りないときに、中立的な代替を見つけましょう。

AI Subscription Guide aisubscriptionguide.com

あなたの実際の仕事に合うAIサブスクリプションを学びましょう。

OpenAI crawler docs platform.openai.com/docs/gptbot

OpenAIの現在のクローラーとユーザーエージェントの案内を確認しましょう。

Google crawler docs developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Googleのクローラー名、インデックスの挙動、AI関連の制御を確認しましょう。

Anthropic support support.anthropic.com/

Claudeのアカウント、データ、クローラーの現在の案内を確認しましょう。

FAQ

よくある疑問。

個人の写真へのAI学習を止められますか?

露出を減らすことはできますが、写真が公開された後は完全なコントロールを保証できません。機微な写真は非公開にし、プラットフォームの設定を見直し、公開の高解像度アップロードを避け、自分のウェブサイトにはクローラー制御を使いましょう。

履歴書をAIチャットボットに貼り付けてもよいですか?

作業に不要な情報を削除してからにしてください。氏名、住所、電話番号、生年月日、署名、雇用主の秘密、推薦者などは、多くの場合プレースホルダーに置き換えられます。

家族の書類をAIにアップロードしてもよいですか?

注意してください。診断書、パスポート、学校の書類、法的書類、銀行の書類、家族の記録には、他人に関する機微なデータが含まれることがあります。承認されたプライバシー設定を使うか、アップロードしないでください。

非公開のプロンプトはAIの学習データになりますか?

製品、アカウントの種類、設定によって異なります。一部の提供者は、データを異なる方法で扱う制御、チームプラン、API規約を提供しています。機微な情報を入力する前に、現在の設定を確認してください。

AI企業が自分のウェブサイトで学習するのを完全に止められますか?

一つの技術的スイッチだけでは無理です。robots.txtは準拠するクローラーに立ち去るよう求めることができますが、これは任意であり、すでに他所に存在するコピーを削除するものではありません。

robots.txtは法的にAI学習をブロックしますか?

robots.txtは技術的な慣習であり、それ自体は契約ではありません。あなたの方針の裏付けにはなりますが、法的な問題は管轄、規約、著作権、契約、執行に左右されます。