내 프롬프트
도구와 계정이 해당 용도로 승인되지 않은 한, 이름, 주소, 비밀번호, 건강 정보, 법적 문제, 아동 정보, 기밀 업무 데이터를 붙여넣지 마세요.
개인 사용자 가이드
이 가이드는 우선 평범한 사람들을 위한 것입니다. 블로그, 사진, 이력서, 가족 문서, 개인 메모, 학교 과제, 고객 파일, 소셜 게시물, 프롬프트가 대상입니다. 무엇을 차단할 수 있고, 무엇은 줄이는 것만 가능하며, 무엇은 생각 없이 절대 업로드해서는 안 되는지 배우세요.
빠른 답변
가장 안전한 조치는 크롤러 차단만이 아닙니다. 무엇을 공개하지 않을지, 무엇을 붙여넣지 않을지, 어떤 계정 설정을 확인할지, 그리고 어떤 파일은 AI 도구에서 완전히 배제해야 하는지를 아는 것입니다.
도구와 계정이 해당 용도로 승인되지 않은 한, 이름, 주소, 비밀번호, 건강 정보, 법적 문제, 아동 정보, 기밀 업무 데이터를 붙여넣지 마세요.
이력서, 계약서, 은행 파일, 진료 서신, 학교 서류, 고객 PDF는 민감정보를 삭제하세요. 데이터가 다른 사람의 것이라면 더 높은 위험으로 취급하세요.
공개 사진에는 얼굴, 위치, 이름, 자동차 번호판, 사적인 행사가 담길 수 있습니다. 민감한 앨범은 비공개로 유지하고 AI 도구에 이미지를 업로드하기 전에 생각하세요.
블로그나 포트폴리오를 운영한다면 robots.txt와 서버 규칙으로 규정을 준수하는 AI 크롤러에게 접근하지 말 것을 요청할 수 있습니다. 다만 오래된 사본을 삭제하지는 않습니다.
개인 체크리스트
무언가를 업로드하거나 붙여넣기 전에 다음 질문을 던져 보세요. 한 가지라도 답이 불편하게 느껴진다면, 자리표시자를 사용하거나 파일을 제거하거나 더 통제된 계정을 사용하세요.
이것이 나를 식별하나요? 이름, 주소, 전화번호, 이메일, 서명, 생일, 여권 번호, 얼굴, 목소리 또는 정확한 위치.
다른 사람을 식별하나요? 아동, 배우자, 고객, 환자, 학생, 동료, 세입자, 직원 또는 의뢰인.
이것을 온라인에 공개할 수 있나요? 그렇지 않다면, 아무 AI 프롬프트나 안전한 개인 노트처럼 취급하지 마세요.
세부 정보를 대체할 수 있나요? 정확한 데이터가 필요하지 않을 때는 "인물 A", "회사 B", 가짜 날짜, 대략적인 위치, 축약한 발췌를 사용하세요.
계정 설정을 알고 있나요? 소비자, 팀, API, 엔터프라이즈 계정은 데이터를 다르게 처리할 수 있습니다. 현재 설정을 확인하세요.
기술적 계층
robots.txt, 서버 로그, 방화벽 규칙, 눈에 보이는 콘텐츠 정책을 사용하세요. 이는 규정을 준수하는 크롤링을 줄이지만, 오래된 사본을 제거하거나 악의적 행위자를 막지는 못합니다.
제공업체의 데이터 제어, 채팅 기록 설정, 팀 요금제, API 약관, 보존 옵션, 옵트아웃을 사용하세요. 이는 크롤러 차단과 별개입니다.
고객 파일, 인사 기록, 기밀 문서를 업로드하기 전에 고객 허가, 회사 정책, 민감정보 삭제, 승인된 도구, 접근 제어를 사용하세요.
의사결정 지도
데이터가 이용 가능해지는 지점부터 시작하세요. 프롬프트, 공개 블로그, 비공개 PDF, 사진 앨범, 클라우드 드라이브, 업무 문서는 서로 다른 위험 표면입니다.
유용한 개인정보 보호 습관은 지루하지만 강력합니다. 덜 업로드하고, 민감정보를 더 많이 삭제하고, 비공개 앨범을 비공개로 유지하고, 설정을 확인하고, 크롤러 차단은 적합한 곳에서만 사용하세요.
크롤러 매트릭스
| 사용자 에이전트 | 회사 | 왜 중요한가 | 주의 사항 |
|---|---|---|---|
GPTBot | OpenAI | OpenAI 웹 크롤링 제어에 흔히 사용됩니다. | 이 크롤러가 AI 관련 용도로 공개 페이지를 가져오는 것을 원치 않으면 차단하세요. 현재 OpenAI 문서를 확인하세요. |
ChatGPT-User | OpenAI | 많은 논의에서 사용자가 유발하는 브라우징/가져오기 에이전트입니다. | 차단하면 ChatGPT 사용자가 페이지를 읽어 달라고 요청하는 것을 막을 수 있습니다. 이는 광범위한 학습 크롤링과 의도가 다릅니다. |
Google-Extended | Google이 일부 생성형 AI 사용 사례를 위해 문서화한 제어입니다. | 이는 Google 검색을 차단하는 것과 다릅니다. 검색 노출이 영향받기를 원하지 않는 한 Googlebot을 차단하지 마세요. | |
ClaudeBot | Anthropic | 크롤러 제어 논의에서 보이는 Anthropic 크롤러 이름입니다. | Anthropic의 최신 문서를 확인한 후에만 사용하세요. |
Claude-SearchBot | Anthropic | 공개 안내에서 보이는 검색 관련 Claude 크롤러 이름입니다. | 검색 방식 에이전트를 차단하기 전에 노출 측면의 절충을 고려하세요. |
PerplexityBot | Perplexity | 퍼블리셔들이 논의하는 Perplexity 크롤러/사용자 에이전트입니다. | 차단하면 Perplexity 방식 답변 엔진이 콘텐츠를 발견하거나 인용하는 방식에 영향을 줄 수 있습니다. |
CCBot | Common Crawl | 대규모 웹 데이터셋에 사용되는 공개 웹 크롤러입니다. | 페이지가 공개 크롤 코퍼스에 복사되기를 원하지 않는 퍼블리셔들이 흔히 차단합니다. |
Bytespider | ByteDance | ByteDance와 연관된 크롤러입니다. | 광범위한 AI 크롤러 차단 목록을 원한다면 검토할 만합니다. |
정적 도구
크롤링하지 말 것을 요청하고 싶은 크롤러를 선택하세요. 이 생성기는 브라우저 안에서만 실행됩니다. 데이터를 어디에도 전송하지 않습니다. 배포하기 전에 현재 공식 사용자 에이전트 이름을 확인하세요.
# AI 크롤러 제어: 배포하기 전에 현재 사용자 에이전트 이름을 확인하세요.
# 이것은 자발적입니다. robots.txt는 법적 잠금장치가 아닙니다.
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: PerplexityBot
Disallow: /
User-agent: CCBot
Disallow: /
경고: 사용자가 유발하는 에이전트나 검색 관련 에이전트를 차단하면 AI 지원 탐색, 미리보기, 인용이 줄어들 수 있습니다.
공식 참고 자료
현재 OpenAI 크롤러 및 사용자 에이전트 안내를 확인하세요.
Google 크롤러 문서 developers.google.com/search/docs/crawling-indexing/overview-google-crawlersGoogle 크롤러 이름, 색인 동작, AI 관련 제어를 확인하세요.
Anthropic 지원 support.anthropic.com/현재 Claude 계정, 데이터, 크롤러 안내를 확인하세요.
Perplexity www.perplexity.ai/현재 Perplexity 제품 및 퍼블리셔 정보를 검토하세요.
Common Crawl commoncrawl.org/연구에 사용되는 주요 공개 웹 크롤 데이터셋 하나를 이해하세요.
로봇 배제 프로토콜 www.rfc-editor.org/rfc/rfc9309공식 robots.txt 프로토콜 참조 문서입니다.
관련 가이드
워크플로를 선택하기 전에 AI 모델을 비교하세요.
ChatGPT Alternatives chatgpt-alternatives.com하나의 AI 제공업체로 충분하지 않을 때 중립적인 대안을 찾으세요.
AI Subscription Guide aisubscriptionguide.com실제 업무에 맞는 AI 구독이 무엇인지 알아보세요.
KIWerkzeuge kiwerkzeuge.com독일어 AI 도구 디렉터리 및 개인정보 보호 중심 AI 도구 가이드.
BoiteAIA boiteaia.com챗봇, 이미지 도구, 비즈니스용을 위한 프랑스어 AI 도구 디렉터리.
MultipleChat AI multiplechat.ai하나의 인터페이스에서 여러 AI 모델을 사용하고 프로젝트별로 워크플로를 분리하세요.
FAQ
노출을 줄일 수는 있지만, 사진이 일단 공개되면 완전한 통제를 보장할 수는 없습니다. 민감한 사진은 비공개로 유지하고, 플랫폼 설정을 검토하며, 공개된 고해상도 업로드를 피하고, 본인 웹사이트에는 크롤러 제어를 사용하세요.
해당 작업에 필요하지 않은 세부 정보를 제거한 후에만 하세요. 이름, 주소, 전화번호, 생년월일, 서명, 고용주 기밀, 추천인 정보는 대개 자리표시자로 대체할 수 있습니다.
주의하세요. 진료 서신, 여권, 학교 서류, 법률 문서, 은행 파일, 가족 기록에는 다른 사람에 관한 민감정보가 포함될 수 있습니다. 승인된 개인정보 보호 설정을 사용하거나 업로드하지 마세요.
제품, 계정 유형, 설정에 따라 다릅니다. 일부 제공업체는 데이터를 다르게 취급하는 제어, 팀 요금제, API 약관을 제공합니다. 민감한 정보를 입력하기 전에 현재 설정을 확인하세요.
단 하나의 기술적 스위치로는 불가능합니다. robots.txt는 규정을 준수하는 크롤러에게 접근하지 말 것을 요청할 수 있지만, 이는 자발적이며 이미 다른 곳에 존재하는 사본을 제거하지는 않습니다.
robots.txt는 기술적 관례일 뿐 그 자체로 계약은 아닙니다. 정책적 입장을 뒷받침할 수는 있지만, 법적 문제는 관할권, 약관, 저작권, 계약, 집행에 따라 달라집니다.
AI 전용 에이전트를 차단하는 것을 Googlebot을 차단하는 것과 동일하게 취급해서는 안 됩니다. 일반 검색 크롤러를 차단하면 검색 노출이 저하될 수 있습니다. 각 사용자 에이전트를 신중히 확인하세요.
절충 관계를 이해하는 경우에만 하세요. 사용자가 유발하는 에이전트는 누군가 AI 도구에 사이트를 읽어 달라고 요청할 때 페이지를 가져올 수 있습니다. 이를 차단하면 AI 지원 탐색이 줄어들 수 있습니다.