私のプロンプト
ツールとアカウントがその用途に承認されていない限り、氏名、住所、パスワード、健康情報、法的な問題、子どもの情報、機密の業務データを貼り付けないでください。
個人向けガイド
これはまず普通の人のためのものです:ブログ、写真、履歴書、家族の書類、私的なメモ、学校の課題、顧客ファイル、SNSの投稿、プロンプト。何をブロックできるのか、何は減らせるだけなのか、そして何を考えなしにアップロードしてはいけないのかを学びましょう。
手早い答え
最も安全な手立ては、クローラーのブロックだけではありません。何を公開しないか、何を貼り付けないか、どのアカウント設定を確認するか、そしてどのファイルはAIツールから完全に遠ざけるべきか、を知ることです。
ツールとアカウントがその用途に承認されていない限り、氏名、住所、パスワード、健康情報、法的な問題、子どもの情報、機密の業務データを貼り付けないでください。
履歴書、契約書、銀行の書類、診断書、学校の書類、顧客のPDFは墨消ししましょう。データが他人のものなら、より高いリスクとして扱ってください。
公開写真には、顔、場所、氏名、ナンバープレート、私的な出来事が写っていることがあります。機微なアルバムは非公開に保ち、AIツールに画像をアップロードする前に一考してください。
ブログやポートフォリオを運営しているなら、robots.txtとサーバー規則で、準拠するAIクローラーに立ち去るよう求められます。ただし古いコピーは消せません。
個人向けチェックリスト
何かをアップロードしたり貼り付けたりする前に、これらの問いを立ててください。一つでも答えに不安を感じたら、プレースホルダーを使う、ファイルを削除する、またはより管理されたアカウントを使いましょう。
これは私を特定しますか? 氏名、住所、電話、メール、署名、誕生日、パスポート番号、顔、声、正確な位置。
それは他人を特定しますか? 子ども、パートナー、顧客、患者、生徒、同僚、入居者、従業員、クライアント。
私はそれをオンラインで公開しますか? いいえなら、その辺のAIプロンプトを安全な非公開ノートのように扱わないでください。
詳細を置き換えられますか? 正確なデータが不要なら、「人物A」「会社B」、架空の日付、大まかな場所、短縮した抜粋を使いましょう。
アカウント設定を把握していますか? 個人向け、チーム、API、エンタープライズのアカウントでは、データの扱いが異なる場合があります。現在の設定を確認してください。
技術的なレイヤー
robots.txt、サーバーログ、ファイアウォール規則、目に見えるコンテンツ方針を使いましょう。これは準拠するクロールを減らしますが、古いコピーを削除したり悪質な者を止めたりはしません。
提供者のデータ制御、チャット履歴設定、チームプラン、API規約、保持オプション、オプトアウトを使いましょう。これはクローラーのブロックとは別です。
顧客ファイル、人事記録、機密書類をアップロードする前に、顧客の許可、会社の方針、墨消し、承認済みツール、アクセス制御を使いましょう。
判断マップ
あなたのデータが利用可能になる場所から始めましょう。プロンプト、公開ブログ、非公開のPDF、写真アルバム、クラウドドライブ、業務文書は、それぞれ異なるリスク面です。
有用なプライバシーの習慣は地味ですが強力です:アップロードを減らし、より多く墨消しし、非公開アルバムは非公開に保ち、設定を確認し、クローラーブロックは適した場所にだけ使う。
クローラー一覧表
| ユーザーエージェント | 企業 | なぜ重要か | 注意点 |
|---|---|---|---|
GPTBot | OpenAI | OpenAIのウェブクロール制御でよく使われます。 | このクローラーにAI関連の用途で公開ページを取得させたくない場合はブロックします。最新のOpenAIのドキュメントを確認してください。 |
ChatGPT-User | OpenAI | 多くの議論でユーザー起動の閲覧/取得エージェントとされています。 | ブロックすると、ChatGPTユーザーがあなたのページを読ませることを止められます。これは広範な学習クロールとは意図が異なります。 |
Google-Extended | 一部の生成AI用途向けにGoogleが文書化する制御です。 | これはGoogle検索をブロックすることと同じではありません。検索の可視性に影響してよい場合を除き、Googlebotはブロックしないでください。 | |
ClaudeBot | Anthropic | クローラー制御の議論で見られるAnthropicのクローラー名です。 | Anthropicの最新ドキュメントを確認したうえでのみ使ってください。 |
Claude-SearchBot | Anthropic | 公開のガイダンスで見られる検索関連のClaudeクローラー名です。 | 検索型エージェントをブロックする前に、可視性のトレードオフを検討してください。 |
PerplexityBot | Perplexity | パブリッシャーの間で議論されるPerplexityのクローラー/ユーザーエージェントです。 | ブロックすると、Perplexity型の回答エンジンでのコンテンツの発見や引用のされ方に影響することがあります。 |
CCBot | Common Crawl | 大規模ウェブデータセットに使われる公開ウェブクローラーです。 | 公開のクロールコーパスにページをコピーされたくないパブリッシャーによって、よくブロックされます。 |
Bytespider | ByteDance | ByteDanceに関連するクローラーです。 | 広範なAIクローラーのブロックリストを作りたい場合に見直すと有用です。 |
静的ツール
クロールしないよう求めたいクローラーを選択してください。このジェネレーターはブラウザ内でのみ動作します。データはどこにも送信しません。デプロイする前に、現在の公式ユーザーエージェント名を確認してください。
# AIクローラー制御:デプロイ前に現在のユーザーエージェント名を確認してください。
# これは任意です。robots.txtは法的なロックではありません。
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: PerplexityBot
Disallow: /
User-agent: CCBot
Disallow: /
警告:ユーザー起動または検索関連のエージェントをブロックすると、AIによる発見、プレビュー、引用が減ることがあります。
公式リファレンス
現在のOpenAIのクローラーとユーザーエージェントのガイダンスを確認します。
Googleクローラーのドキュメント developers.google.com/search/docs/crawling-indexing/overview-google-crawlersGoogleのクローラー名、インデックス動作、AI関連の制御を確認します。
Anthropicサポート support.anthropic.com/現在のClaudeのアカウント、データ、クローラーのガイダンスを確認します。
Perplexity www.perplexity.ai/現在のPerplexityの製品とパブリッシャー情報を確認します。
Common Crawl commoncrawl.org/研究に使われる主要な公開ウェブクロールデータセットの一つを理解します。
ロボット排除プロトコル www.rfc-editor.org/rfc/rfc9309正式なrobots.txtプロトコルのリファレンスです。
関連ガイド
ワークフローを選ぶ前にAIモデルを比較します。
ChatGPT Alternatives chatgpt-alternatives.com一つのAI提供者だけでは足りないときに、中立的な代替を見つけます。
AI Subscription Guide aisubscriptionguide.comどのAIサブスクリプションが実際の仕事に合うかを学びます。
KIWerkzeuge kiwerkzeuge.comドイツ語のAIツールディレクトリと、プライバシー重視のAIツールガイド。
BoiteAIA boiteaia.comチャットボット、画像ツール、ビジネス利用のためのフランス語AIツールディレクトリ。
MultipleChat AI multiplechat.ai複数のAIモデルを一つのインターフェースで使い、プロジェクトごとにワークフローを分けて管理します。
FAQ
露出を減らすことはできますが、写真が公開された後は完全なコントロールを保証できません。機微な写真は非公開にし、プラットフォームの設定を見直し、公開の高解像度アップロードを避け、自分のウェブサイトにはクローラー制御を使いましょう。
作業に不要な情報を削除してからにしてください。氏名、住所、電話番号、生年月日、署名、雇用主の秘密、推薦者などは、多くの場合プレースホルダーに置き換えられます。
注意してください。診断書、パスポート、学校の書類、法的書類、銀行の書類、家族の記録には、他人に関する機微なデータが含まれることがあります。承認されたプライバシー設定を使うか、アップロードしないでください。
製品、アカウントの種類、設定によって異なります。一部の提供者は、データを異なる方法で扱う制御、チームプラン、API規約を提供しています。機微な情報を入力する前に、現在の設定を確認してください。
一つの技術的スイッチだけでは無理です。robots.txtは準拠するクローラーに立ち去るよう求めることができますが、これは任意であり、すでに他所に存在するコピーを削除するものではありません。
robots.txtは技術的な慣習であり、それ自体は契約ではありません。あなたの方針の裏付けにはなりますが、法的な問題は管轄、規約、著作権、契約、執行に左右されます。
AI専用のエージェントをブロックすることは、Googlebotをブロックすることと同じに扱うべきではありません。通常の検索クローラーをブロックすると、検索での可視性が損なわれることがあります。各ユーザーエージェントを慎重に確認してください。
トレードオフを理解している場合に限ります。ユーザー起動のエージェントは、人がAIツールにサイトを読むよう頼んだときにページを取得することがあります。これらをブロックすると、AIによる発見が減る可能性があります。