개인을 위하여

개인 AI 개인정보 보호는 업로드하기 전에 시작됩니다.

대부분의 AI 개인정보 보호 실수는 조용히 일어납니다: 프롬프트에 스캔한 여권, 공개 페이지에 올린 아이의 사진, 챗봇에 붙여 넣은 이력서, 또는 요약을 위해 업로드한 개인 메모 같은 것입니다. 이 페이지는 무엇이 괜찮은지, 무엇에 민감정보 삭제가 필요한지, 무엇을 오프라인에 두어야 하는지 결정하는 데 도움을 줍니다.

개인 위험 지도

대부분의 사람에게는 먼저 법률 이론이 필요하지 않습니다. 업로드 규칙이 필요합니다.

AI 개인정보 보호는 흔히 일상적인 순간에 실패합니다: 챗봇에게 여러분의 전체 주소가 담긴 항의 편지를 다시 써 달라고 요청하거나, 요약하려고 진료 PDF를 업로드하거나, 고객 이메일을 붙여 넣거나, 아이의 사진을 AI 이미지로 바꾸는 것입니다. 질문은 단지 "이것이 모델을 학습시킬까?"만이 아닙니다. "이 데이터가 애초에 내 손을 떠나야 하는가?"입니다.

  1. 녹색: 공개된 사실, 일반적인 예시, 이미 게시하려고 계획했던 텍스트, 익명화된 초안.
  2. 노란색: 이력서, 학교 과제, 개인 편지, 민감한 맥락이 없는 사진, 민감정보를 삭제한 후의 업무 초안.
  3. 빨간색: 신분증, 은행 문서, 진료 기록, 법적 분쟁, 비밀번호, 아이의 비공개 사진, 고객 데이터, 그리고 공유할 권한이 없는 모든 것.

가장 좋은 차단은 업로드하지 않는 것입니다.

크롤러 규칙은 공개 페이지에 도움이 됩니다. 여러분이 자발적으로 도구에 붙여 넣는 비공개 파일은 보호하지 못합니다. 개인에게 가장 강력한 통제는 무엇을 로컬에 둘지 선택하는 것입니다.

실전 예시

과도하게 공유하지 않고 AI를 사용하는 방법.

이력서

전화번호, 도로명 주소, 생일, 서명, 추천인을 제거하십시오. 자리표시자를 사용하여 구조, 어조, 표현에 대한 도움을 요청하십시오.

진료 서신

전체 파일을 무심코 업로드하지 마십시오. 쉬운 언어로 된 도움이 필요하다면 먼저 이름, 날짜, 병원 번호, 식별 세부 정보를 제거하십시오.

가족 사진

제공업체와 제품 사용에 대해 안심할 수 없다면 얼굴, 아이, 집 내부, 위치 정보가 많은 사진을 업로드하지 마십시오.

업무 이메일

고객 이름, 프로젝트 이름, 가격, 내부 갈등 세부 사항을 대체하십시오. 가능한 한 질문을 일반적으로 유지하십시오.

무엇이 개인정보에 해당하는가

개인정보는 대부분의 사람이 예상하는 것보다 더 많은 경로로 AI 시스템에 도달합니다.

사람들이 AI 학습을 떠올릴 때 보통 어떤 기업이 문서를 의도적으로 복사하는 모습을 상상합니다. 실제로 개인정보는 여러 작고 일상적인 채널을 통해 동시에 유입되는 경향이 있습니다. 이러한 채널을 이해하면 여러분의 주의를 실제로 어디에 쏟는 것이 가치 있는지 결정하는 데 도움이 됩니다. 이 중 어느 것도 법률 자문이 아니며, 각 제공업체의 정확한 동작은 시간이 지나면서 바뀌므로, 아래 설명을 보장이 아니라 일반적인 지도로 취급하십시오.

프롬프트와 채팅 기록

후속 질문을 포함해 여러분이 챗봇에 입력하는 텍스트는 데이터입니다. 제품, 계정 유형, 설정에 따라 그 일부는 보존되거나, 품질을 위해 사람이 검토하거나, 모델 개선에 사용될 수 있습니다. 소비자 기본값과 비즈니스 또는 API 약관은 흔히 다릅니다. 여러분이 사용하는 특정 도구의 현재 설정을 확인하십시오.

업로드와 첨부 파일

여러분이 첨부하는 파일, 예컨대 PDF, 스프레드시트, 스크린샷, 이미지는 제공업체에 의해 처리됩니다. 하나의 업로드에는 여러분이 의도한 것보다 훨씬 많은 것이 담길 수 있으며, 여기에는 메타데이터, 숨겨진 열, 주석, 사진에 내장된 위치 태그가 포함됩니다.

공개 게시물과 페이지

공개로 설정된 소셜 프로필, 포럼 댓글, 리뷰, 개인 웹사이트를 포함해 열린 웹에서 보이는 것은 무엇이든 크롤러가 가져올 수 있습니다. 일단 콘텐츠가 공개되어 복사되면, 나중의 삭제로는 다른 곳에 캐시된 모든 사본을 확실히 제거할 수 없습니다.

스크래핑된 소셜 프로필

소셜 플랫폼의 공개 사진, 소개, 캡션, 연결은 대규모로 수집될 수 있습니다. 플랫폼 설정과 약관은 제각각이고, 원치 않는 스크래핑에 대한 집행은 일관되지 않으므로, "공개" 설정은 "수집될 가능성이 있음"으로 취급하는 것이 가장 좋습니다.

데이터 브로커

브로커는 공개 기록, 구매 내역, 앱 권한, 기타 출처로부터 프로필을 조합한 다음 이를 재판매합니다. 이 데이터는 후속 시스템에 공급될 수 있습니다. 여러분이 목록에 오르기를 스스로 선택하지 않은 경우가 많으며, 그렇기 때문에 옵트아웃 요청은 불완전하고 느리더라도 중요합니다.

제3자 공유

다른 사람도 여러분의 데이터를 노출할 수 있습니다: 친구가 사진에 태그를 달거나, 동료가 여러분의 주소가 포함된 이메일 스레드를 붙여 넣거나, 가족이 공유 문서를 업로드하는 것입니다. 다른 사람이 하는 일을 완전히 통제할 수는 없지만, 여러분이 기여하는 것은 줄일 수 있습니다.

유용한 사고 모델.

여러분의 노출은 대략 여러분이 업로드하는 것, 여러분이 게시하는 것, 다른 사람이 여러분에 관해 게시하는 것의 합입니다. 첫 번째에 대해 가장 많은 통제력을, 두 번째에 대해 상당한 통제력을, 세 번째에 대해 부분적인 영향력만 가집니다. 그 순서로 노력을 기울이십시오.

노출 줄이기

오후 한나절에 해낼 수 있는 실용적인 체크리스트.

모든 것을 한 번에 할 필요는 없습니다. 아래 목록을 명령이 아니라 메뉴로 취급하십시오. 각 항목은 노출을 조금씩 낮추며, 그 어느 것도 여러분을 보이지 않게 만들지는 않습니다. 그것은 접근법의 실패가 아니라 솔직한 한계입니다.

소비자 기본값은 다릅니다

소비자용 AI 학습 기본값이 제공업체마다 어떻게 다른지, 그리고 왜 검증해야 하는지.

제공업체는 소비자 입력이 모델 개선에 사용되는지에 대해 서로 다른 입장을 취하며, 그러한 입장은 정책 업데이트, 제품 등급, 지역에 따라 바뀝니다. 아래 표는 여러분이 마주칠 수 있는 차이의 종류를 설명합니다. 이는 의도적으로 일반적으로 작성되었으며 특정 제공업체에 대한 현재의 진술이 아닙니다. 이는 정확히 큰 예고 없이 바뀌는 종류의 세부 사항이므로, 이에 의존하기 전에 항상 공식 문서와 제품 내 설정과 대조하여 확인하십시오.

요소의미할 수 있는 것확인하는 방법
계정 유형무료, 개인 유료, 팀, 엔터프라이즈 요금제는 서로 다른 데이터 약관의 적용을 받을 수 있습니다.일반적인 마케팅 페이지가 아니라 여러분의 정확한 요금제에 묶인 약관을 읽으십시오.
학습 기본값일부 제품은 소비자 입력을 기본적으로 모델 개선에 사용하고, 다른 제품은 그렇지 않거나 옵트인을 요구합니다.앱 내부에서 데이터 제어 또는 개인정보 보호 설정을 찾으십시오.
옵트아웃 제공 여부옵트아웃이 존재할 수도, 특정 지역에 한정될 수도, 소급 적용되지 않을 수도 있습니다.해당 설정이 과거 데이터에 영향을 미치는지 아니면 향후 입력에만 영향을 미치는지 확인하십시오.
API 대 앱API 및 개발자 약관은 흔히 소비자용 채팅 앱과 다르게 데이터를 취급합니다.API 데이터 사용 정책을 앱 정책과 별도로 확인하십시오.
사람 검토입력은 모델 학습과는 별개로 안전 또는 품질을 위해 사람이 검토할 수 있습니다.제공업체가 검토, 보존, 직원 접근을 어떻게 설명하는지 읽으십시오.

가정하지 말고 검증하십시오.

가장 안전한 가정은, 보존되기를 원치 않는 것은 애초에 입력하거나 업로드해서는 안 된다는 것입니다. 설정은 도움이 되지만, 여러분이 도구를 사용하는 날에 그것을 이해하는 수준만큼만 신뢰할 수 있습니다.

붙여 넣기 전에 민감정보를 삭제하십시오

콘텐츠를 익명화하는 것은 가장 가치 있는 단 하나의 습관입니다.

민감정보 삭제는 피해망상에 관한 것이 아닙니다. 도구에게 작업에 필요한 것만 제공하는 것에 관한 것입니다. 잘 익명화된 프롬프트는 대개 똑같이 좋은 답변을 만들어 냅니다. 모델이 문장을 다듬는 데 여러분의 진짜 주소를 필요로 하는 경우가 드물기 때문입니다. 아래는 여러분이 적용할 수 있는 간단한 이전-이후 패턴입니다.

이전:
"이것을 다시 써 줘: Dr. Meier께, 제 아들 Leon Muller에 관하여,
Zurich Clinic의 환자 ID 44-8821, 12 March 예약 건..."

이후:
"이것을 정중하고 격식 있는 어조로 다시 써 줘: [DOCTOR]께, 제 자녀
[NAME]에 관하여, [CLINIC]의 환자 ID [ID], [DATE] 예약 건..."

이름과 관계

실제 이름을 [NAME] 또는 [CHILD], [MANAGER] 같은 역할로 대체하십시오. 여러분이 원하는 표현 도움은 실제 이름에 의존하는 경우가 거의 없습니다.

숫자와 식별번호

계좌번호, 환자 ID, 전화번호, 생년월일을 자리표시자로 바꾸십시오. 계산에 정확한 숫자가 중요하다면 그 부분은 오프라인으로 처리하는 것을 고려하십시오.

파일과 이미지

서명, 편지지 머리글, 참조 번호를 잘라내십시오. 사진의 경우 위치 메타데이터를 제거하고 여러분이 사는 곳이나 일하는 곳을 드러내는 배경을 피하십시오.

이 중 어느 것도 익명성을 보장하지는 않습니다. 맥락은 때때로 이름 없이도 사람을 재식별할 수 있기 때문입니다. 그러나 이것은 가장 명백하고 가장 해로운 식별 정보를 제거해 주며, 이는 일상적 사용에 있어 합리적이고 달성 가능한 목표입니다.

오래된 콘텐츠와 옵트아웃

이미 공개된 것을 관리하기: 검색 결과와 데이터 브로커.

미래의 노출을 줄이는 것은 과거를 정리하는 것보다 쉽지만, 과거도 여전히 중요합니다. 이 섹션은 이미 유통되고 있는 것을 줄이는 현실적이지만 불완전한 방법을 다룹니다. 부분적인 결과, 지연, 제거된 콘텐츠의 간헐적 재등장을 예상하십시오. 그것이 이 작업의 솔직한 본질이기 때문입니다.

  1. 목록화: 여러분의 이름, 사용자명, 이메일 주소를 검색하여 무엇이 공개적으로 색인되어 있는지 확인하십시오. 집 주소, 전화번호, 민감한 사진 등 가장 위험이 높은 항목을 먼저 기록하십시오.
  2. 출처 우선: 가능한 경우 검색 결과만 쫓기보다는 오래된 프로필이나 포럼 게시물 같은 원래 출처에서 콘텐츠를 제거하거나 비공개로 만드십시오.
  3. 검색 결과 제거: 주요 검색 엔진은 특정 민감한 개인정보에 대해 제거 요청 도구를 제공합니다. 이는 기저 페이지가 아니라 검색 노출에 영향을 미치며, 기준은 지역에 따라 다릅니다.
  4. 브로커 옵트아웃: 더 큰 데이터 브로커와 사람 검색 사이트에 삭제 요청을 제출하십시오. 많은 곳이 시간이 지남에 따라 반복 요청을 요구하며, 일부는 요금을 부과하거나 절차를 의도적으로 번거롭게 만듭니다.
  5. 유지 관리: 몇 달마다 다시 확인하십시오. 옵트아웃은 만료될 수 있고, 프로필은 새로운 공개 데이터로부터 다시 구축될 수 있습니다.

중요한 한계.

완벽한 제거 노력조차도 여러분이 행동하기 전에 이미 캐시되거나 보관되거나 스크래핑된 사본을 되돌릴 수는 없습니다. 옵트아웃과 robots.txt는 많은 행위자가 존중하지만 전부는 아닌 자발적 관례입니다. 이를 삭제가 아니라 피해 경감으로 취급하십시오.

오해 대 사실

흔한 오해 바로잡기.

자신 있게 들리는 조언이 온라인에서 빠르게 퍼지며, 그중 일부는 오해를 부릅니다. 아래 짝은 몇 가지 흔한 오해를 좀 더 신중한 해석과 구분합니다. 늘 그렇듯 이것은 교육용 안내이며 법률 자문이 아닙니다.

오해: 게시물을 삭제하면 모든 곳에서 제거된다

사실: 삭제는 원본을 제거할 수 있지만, 사본은 캐시, 아카이브, 이전에 수집된 데이터셋에 남아 있을 수 있습니다. 그래도 나중보다 일찍 삭제하는 것이 낫습니다. 콘텐츠가 복사될 수 있었던 기간을 제한하기 때문입니다.

오해: 하나의 설정이 모든 AI 학습을 멈춘다

사실: 만능 스위치는 없습니다. 앱 설정, 웹사이트 크롤러 제어, 브로커 옵트아웃은 각각 부분적인 별개의 계층입니다. 노출을 줄인다는 것은 이들 중 여러 개를 결합하는 것을 뜻합니다.

오해: 비공개는 곧 보이지 않음을 뜻한다

사실: 계정을 비공개로 표시하는 것은 도움이 되지만, 스크린샷, 재공유, 과거 공개 기간이 흔적을 남길 수 있습니다. "비공개"를 노출의 제거가 아니라 감소로 취급하십시오.

오해: robots.txt가 학습을 법적으로 금지한다

사실: robots.txt는 자발적 기술 관례입니다. 여러분의 선호를 표현하고 정책 입장을 뒷받침할 수 있지만, 그 자체로 계약은 아니며 준수는 보편적이지 않습니다. 법적 문제는 관할권과 구체적 사실에 달려 있습니다.

오해: 여러분이 업로드하는 것만 중요하다

사실: 다른 사람도 여러분의 데이터를 게시할 수 있습니다. 여러분 자신의 업로드를 관리하는 것은 필요하지만 충분하지 않으며, 그렇기 때문에 출처 제거와 브로커 옵트아웃도 계획에 포함되어야 합니다.

오해: 유료 도구는 결코 여러분으로 학습하지 않는다

사실: 일부 유료 또는 비즈니스 등급은 더 강력한 데이터 약관을 제공하지만, 이것이 자동은 아닙니다. 결제가 기본값을 바꾼다고 가정하기보다 여러분의 특정 요금제에 대한 약관을 확인하십시오.

관련 읽을거리

다음 단계.

ModelVersus modelversus.com

워크플로를 선택하기 전에 AI 모델을 비교하세요.

ChatGPT Alternatives chatgpt-alternatives.com

하나의 AI 제공업체로 충분하지 않을 때 중립적인 대안을 찾으세요.

AI Subscription Guide aisubscriptionguide.com

여러분의 실제 업무에 맞는 AI 구독을 알아보세요.

OpenAI 크롤러 문서 platform.openai.com/docs/gptbot

OpenAI의 현재 크롤러 및 사용자 에이전트 안내를 확인하세요.

Google 크롤러 문서 developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Google 크롤러 이름, 색인 동작, AI 관련 제어를 검증하세요.

Anthropic 지원 support.anthropic.com/

현재 Claude 계정, 데이터, 크롤러 안내를 확인하세요.

FAQ

흔한 의문.

개인 사진에 대한 AI 학습을 막을 수 있나요?

노출을 줄일 수는 있지만, 사진이 일단 공개되면 완전한 통제를 보장할 수는 없습니다. 민감한 사진은 비공개로 유지하고, 플랫폼 설정을 검토하고, 공개적인 고해상도 업로드를 피하고, 여러분 자신의 웹사이트에는 크롤러 제어를 사용하십시오.

제 이력서를 AI 챗봇에 붙여 넣어도 될까요?

작업에 필요하지 않은 세부 정보를 제거한 후에만 하십시오. 이름, 주소, 전화번호, 생년월일, 서명, 고용주 기밀, 추천인은 흔히 자리표시자로 대체할 수 있습니다.

가족 문서를 AI에 업로드해도 될까요?

주의하십시오. 진료 서신, 여권, 학교 문서, 법률 서류, 은행 파일, 가족 기록에는 다른 사람에 관한 민감한 데이터가 포함될 수 있습니다. 승인된 개인정보 보호 설정을 사용하거나 업로드하지 마십시오.

비공개 프롬프트가 AI 학습 데이터가 되나요?

제품, 계정 유형, 설정에 따라 다릅니다. 일부 제공업체는 데이터를 다르게 취급하는 제어, 팀 요금제, API 약관을 제공합니다. 민감한 정보를 입력하기 전에 현재 설정을 확인하십시오.

AI 기업이 제 웹사이트로 학습하는 것을 완전히 막을 수 있나요?

하나의 기술적 스위치로는 불가능합니다. robots.txt는 규정을 준수하는 크롤러에게 접근하지 말아 달라고 요청할 수 있지만, 이는 자발적이며 이미 다른 곳에 존재하는 사본을 제거하지는 않습니다.

robots.txt가 AI 학습을 법적으로 차단하나요?

robots.txt는 기술적 관례이며 그 자체로 계약은 아닙니다. 여러분의 정책 입장을 뒷받침할 수는 있지만, 법적 문제는 관할권, 약관, 저작권, 계약, 집행에 달려 있습니다.