Pro soukromé osoby

Osobní soukromí u AI začíná dřív, než něco nahrajete.

Většina chyb v ochraně soukromí u AI se děje potichu: naskenovaný pas v promptu, dětská fotka na veřejné stránce, životopis vložený do chatbota nebo soukromé poznámky nahrané k shrnutí. Tato stránka vám pomůže rozhodnout, co je v pořádku, co potřebuje začernění a co by mělo zůstat offline.

Mapa osobního rizika

Většina lidí nepotřebuje nejdřív právní teorii. Potřebuje pravidla pro nahrávání.

Ochrana soukromí u AI často selhává v běžných okamžicích: když požádáte chatbota, aby přepsal stížnostní dopis s vaší úplnou adresou, nahrajete lékařský PDF k shrnutí, vložíte e-mail klienta nebo z fotky dítěte vytvoříte AI obrázek. Otázka není jen „natrénuje to model?“ Je to „mají tato data vůbec opustit moje ruce?“

  1. Zelená: veřejná fakta, obecné příklady, text, který jste stejně chtěli publikovat, anonymizované koncepty.
  2. Žlutá: životopisy, školní práce, osobní dopisy, fotky bez citlivého kontextu, pracovní koncepty po začernění.
  3. Červená: doklady totožnosti, bankovní dokumenty, zdravotní záznamy, právní spory, hesla, soukromé fotky dětí, zákaznická data a cokoli, k čemu nemáte oprávnění to sdílet.

Nejlepší blokace je nenahrávat.

Pravidla pro crawlery pomáhají u veřejných stránek. Nechrání soukromý soubor, který dobrovolně vložíte do nástroje. Pro soukromé osoby je nejsilnější kontrolou volba toho, co zůstane lokálně.

Praktické příklady

Jak používat AI, aniž byste sdíleli příliš mnoho.

Životopis

Odstraňte telefon, adresu, datum narození, podpis a reference. Ptejte se na strukturu, tón a formulace pomocí zástupných symbolů.

Lékařský dopis

Nenahrávejte celý soubor bezmyšlenkovitě. Pokud potřebujete pomoc se srozumitelnou formulací, nejdřív odstraňte jména, data, čísla ordinace a identifikační údaje.

Rodinná fotka

Nenahrávejte obličeje, děti, interiéry domácnosti ani fotky s bohatými údaji o poloze, pokud vám nevyhovuje daný poskytovatel a použití produktu.

Pracovní e-mail

Nahraďte jména klientů, názvy projektů, ceny a detaily interních konfliktů. Otázku pokud možno formulujte obecně.

Co se počítá jako osobní údaje

Osobní údaje se do systémů AI dostávají víc cestami, než většina lidí čeká.

Když si lidé představí trénink AI, obvykle si vybaví firmu, která záměrně kopíruje dokument. V praxi osobní informace přicházejí naráz mnoha malými, běžnými kanály. Pochopení těchto kanálů vám pomůže rozhodnout, kam se vlastně vyplatí věnovat pozornost. Nic z toho není právní poradenství a přesné chování každého poskytovatele se v čase mění, takže níže uvedené popisy berte spíš jako obecnou mapu než jako záruku.

Prompty a historie chatu

Text, který napíšete do chatbota, včetně navazujících otázek, jsou data. V závislosti na produktu, typu účtu a nastavení může být část z nich uchovávána, kontrolována lidmi kvůli kvalitě nebo použita ke zlepšování modelů. Výchozí nastavení pro spotřebitele a firemní či API podmínky se často liší. Ověřte si aktuální nastavení pro konkrétní nástroj, který používáte.

Nahrané soubory a přílohy

Soubory, které přiložíte, jako PDF, tabulky, snímky obrazovky a obrázky, poskytovatel zpracovává. Jediné nahrání může obsahovat mnohem víc, než zamýšlíte, včetně metadat, skrytých sloupců, komentářů a značek polohy vložených ve fotkách.

Veřejné příspěvky a stránky

Cokoli viditelné na otevřeném webu, včetně veřejně nastavených profilů na sociálních sítích, komentářů na fórech, recenzí a osobních webů, mohou crawlery stáhnout. Jakmile je obsah veřejný a zkopírovaný, pozdější smazání spolehlivě neodstraní každou uloženou kopii jinde.

Stažené profily ze sociálních sítí

Veřejné fotky, medailonky, popisky a kontakty na sociálních platformách lze sbírat ve velkém. Nastavení a podmínky platforem se liší a vymáhání proti nechtěnému stahování je nekonzistentní, takže „veřejné“ nastavení je nejlepší brát jako „potenciálně sesbírané“.

Datoví brokeři

Brokeři sestavují profily z veřejných záznamů, nákupů, oprávnění aplikací a dalších zdrojů a pak je dál prodávají. Tato data mohou napájet navazující systémy. Často jste si nezvolili být na seznamu, a proto na žádostech o odhlášení záleží, i když jsou dílčí a pomalé.

Sdílení třetími stranami

Vaše data mohou vystavit i jiní lidé: kamarád vás označí na fotce, kolega vloží e-mailové vlákno, které obsahuje vaši adresu, nebo člen rodiny nahraje sdílený dokument. Nemůžete plně ovládat, co dělají ostatní, ale můžete omezit to, čím přispíváte vy.

Užitečný myšlenkový model.

Vaše vystavení je zhruba součtem toho, co nahrajete, co publikujete a co o vás publikují ostatní. Nejvíc kontroly máte nad tím prvním, smysluplnou kontrolu nad druhým a jen dílčí vliv na to třetí. Věnujte úsilí v tomto pořadí.

Snižte své vystavení

Praktický kontrolní seznam, který zvládnete za jedno odpoledne.

Nemusíte udělat všechno najednou. Berte seznam níže jako menu, ne jako příkaz. Každá položka trochu sníží vystavení; žádná z nich vás neučiní neviditelnými, a to je poctivé omezení, ne selhání přístupu.

Výchozí nastavení pro spotřebitele se liší

Jak se výchozí nastavení tréninku spotřebitelské AI liší podle poskytovatele a proč si to musíte ověřit.

Poskytovatelé zaujímají různé postoje k tomu, zda se spotřebitelské vstupy používají ke zlepšování modelů, a tyto postoje se mění s aktualizacemi zásad, produktovými úrovněmi a regiony. Tabulka níže popisuje druhy rozdílů, se kterými se můžete setkat. Je záměrně obecná a není aktuálním tvrzením o žádném konkrétním poskytovateli. Než se na cokoli z toho spolehnete, vždy si to ověřte v oficiální dokumentaci a nastavení produktu, protože přesně tento typ detailů se mění bez velkého ohlášení.

FaktorCo to může znamenatJak to zkontrolovat
Typ účtuBezplatné, osobní placené, týmové a podnikové plány se mohou řídit odlišnými podmínkami pro data.Přečtěte si podmínky vázané na váš přesný plán, ne obecnou marketingovou stránku.
Výchozí nastavení tréninkuNěkteré produkty používají spotřebitelské vstupy ke zlepšování modelů ve výchozím nastavení; jiné ne nebo vyžadují souhlas.Hledejte nastavení ovládání dat nebo soukromí uvnitř aplikace.
Dostupnost odhlášeníOdhlášení může existovat, může být omezené na určité regiony nebo se nemusí vztahovat zpětně.Ověřte, zda nastavení ovlivňuje minulá data, nebo jen budoucí vstupy.
API vs. aplikaceAPI a vývojářské podmínky často nakládají s daty jinak než spotřebitelská chatovací aplikace.Zkontrolujte zásady používání dat u API zvlášť od zásad aplikace.
Lidská kontrolaVstupy mohou být kontrolovány lidmi kvůli bezpečnosti nebo kvalitě, což je odlišné od tréninku modelu.Přečtěte si, jak poskytovatel popisuje kontrolu, uchovávání a přístup zaměstnanců.

Ověřujte, nepředpokládejte.

Nejbezpečnější předpoklad je, že cokoli, co byste nechtěli mít uchováno, by nemělo být vůbec napsáno ani nahráno. Nastavení pomáhá, ale je jen tak spolehlivé, jak dobře mu rozumíte v den, kdy nástroj používáte.

Začerněte, než vložíte

Anonymizace obsahu je jediným zvykem s nejvyšší hodnotou.

Začernění není o paranoie; jde o to dát nástroji jen to, co úkol vyžaduje. Dobře anonymizovaný prompt obvykle přinese stejně dobrou odpověď, protože model málokdy potřebuje vaši skutečnou adresu k opravě věty. Níže je jednoduchý vzor před a po, který si můžete přizpůsobit.

Před:
"Přepiš tohle: Vážený pane doktore Meiere, ohledně mého syna Leona Müllera,
pacient ID 44-8821 na Zurich Clinic, termín 12. března..."

Po:
"Přepiš tohle zdvořilým, formálním tónem: Vážený [DOCTOR], ohledně
mého dítěte [NAME], pacient ID [ID] na [CLINIC], termín [DATE]..."

Jména a vztahy

Nahraďte skutečná jména symbolem [NAME] nebo rolí jako [DÍTĚ] či [MANAŽER]. Pomoc s formulací, kterou chcete, téměř nikdy nezávisí na skutečném jméně.

Čísla a doklady

Zaměňte čísla účtů, pacientská ID, telefonní čísla a data narození za zástupné symboly. Pokud na přesném čísle záleží kvůli výpočtu, zvažte, že tuto část uděláte offline.

Soubory a obrázky

Ořízněte podpisy, hlavičky a referenční čísla. U fotek odstraňte metadata polohy a vyhněte se pozadím, která prozrazují, kde bydlíte nebo pracujete.

Nic z toho anonymitu nezaručuje, protože kontext může někdy osobu znovu identifikovat i bez jména. Odstraňuje to ale nejzřejmější a nejškodlivější identifikátory, což je rozumný a dosažitelný cíl pro každodenní použití.

Starý obsah a odhlášení

Správa toho, co už je veřejné: výsledky vyhledávání a datoví brokeři.

Omezit budoucí vystavení je snazší než uklízet minulost, ale minulost stále záleží. Tato část se věnuje realistickým, byť nedokonalým způsobům, jak omezit to, co už koluje. Očekávejte dílčí výsledky, prodlevy a občasné znovuobjevení odstraněného obsahu, protože to je poctivá povaha této práce.

  1. Inventura: vyhledejte své jméno, uživatelská jména a e-mailové adresy, abyste viděli, co je veřejně indexováno. Nejdřív si poznamenejte nejrizikovější položky, jako adresu bydliště, telefonní číslo nebo citlivé fotky.
  2. Nejdřív zdroj: kde to jde, odstraňte nebo zprivátněte obsah přímo u původního zdroje, jako u starého profilu nebo příspěvku na fóru, místo abyste jen honili výsledky vyhledávání.
  3. Odstranění z vyhledávání: velké vyhledávače nabízejí nástroje pro žádost o odstranění určitých citlivých osobních informací. Ty ovlivňují viditelnost ve vyhledávání, ne samotnou stránku, a kritéria se liší podle regionu.
  4. Odhlášení u brokerů: zasílejte žádosti o odstranění větším datovým brokerům a lidem-vyhledávacím službám. Mnoho z nich vyžaduje opakované žádosti v čase a některé zpoplatňují nebo proces záměrně komplikují.
  5. Údržba: kontrolujte to znovu každých pár měsíců. Odhlášení může vypršet a profily lze znovu sestavit z čerstvých veřejných dat.

Důležité omezení.

Ani dokonalá snaha o odstranění nemůže stáhnout kopie, které už byly uloženy do mezipaměti, archivovány nebo staženy dřív, než jste zasáhli. Odhlášení a robots.txt jsou dobrovolné konvence, které mnozí, ale ne všichni aktéři respektují. Berte je jako snížení škod, ne jako smazání.

Mýty vs. realita

Vyjasnění častých nedorozumění.

Sebejistě znějící rady kolují po internetu rychle a některé z nich jsou zavádějící. Dvojice níže oddělují pár častých mýtů od pečlivějšího čtení. Jako vždy jde o vzdělávací vodítko, ne o právní poradenství.

Mýtus: smazání příspěvku ho odstraní všude

Realita: smazání může odstranit originál, ale kopie mohou přetrvávat v mezipamětech, archivech a datasetech sesbíraných dříve. Smazat dřív je stále lepší než později, protože to omezuje, jak dlouho byl obsah k dispozici ke kopírování.

Mýtus: jediné nastavení zastaví veškerý trénink AI

Realita: neexistuje univerzální vypínač. Nastavení aplikací, ovládání crawlerů na webu a odhlášení u brokerů jsou oddělené vrstvy, každá dílčí. Snížit vystavení znamená kombinovat několik z nich.

Mýtus: soukromé znamená neviditelné

Realita: označit účet jako soukromý pomáhá, ale snímky obrazovky, sdílení dál a minulá veřejná období mohou zanechat stopy. Berte „soukromé“ jako snížení, ne odstranění vystavení.

Mýtus: robots.txt právně zakazuje trénink

Realita: robots.txt je dobrovolná technická konvence. Může vyjádřit vaši preferenci a podpořit stanovisko, ale sám o sobě není smlouvou a dodržování není univerzální. Právní otázky závisí na jurisdikci a konkrétních skutečnostech.

Mýtus: záleží jen na tom, co nahrajete

Realita: vaše data mohou publikovat i ostatní. Správa vlastních nahrávek je nutná, ale ne dostačující, a proto do plánu patří i odstranění u zdroje a odhlášení u brokerů.

Mýtus: placené nástroje na vás nikdy netrénují

Realita: některé placené nebo firemní úrovně skutečně nabízejí silnější podmínky pro data, ale není to automatické. Ověřte si podmínky pro svůj konkrétní plán, místo abyste předpokládali, že placení mění výchozí nastavení.

Související čtení

Další kroky.

ModelVersus modelversus.com

Porovnejte AI modely, než si vyberete workflow.

ChatGPT Alternatives chatgpt-alternatives.com

Najděte neutrální alternativy, když jeden poskytovatel AI nestačí.

AI Subscription Guide aisubscriptionguide.com

Zjistěte, které předplatné AI se hodí k vaší skutečné práci.

Dokumentace crawleru OpenAI platform.openai.com/docs/gptbot

Zkontrolujte aktuální pokyny ke crawleru a user agentu OpenAI.

Dokumentace crawlerů Google developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Ověřte názvy crawlerů Google, chování indexování a ovládání související s AI.

Podpora Anthropic support.anthropic.com/

Zkontrolujte aktuální pokyny k účtu, datům a crawleru Claude.

FAQ

Časté pochybnosti.

Můžu zastavit trénink AI na svých osobních fotkách?

Vystavení můžete snížit, ale plnou kontrolu nezaručíte, jakmile jsou fotky veřejné. Citlivé fotky mějte soukromé, projděte nastavení platforem, vyhýbejte se veřejnému nahrávání ve vysokém rozlišení a pro svůj vlastní web používejte ovládání crawlerů.

Mám vkládat svůj životopis do AI chatbota?

Jen po odstranění údajů, které pro úkol nepotřebujete. Jména, adresy, telefonní čísla, data narození, podpisy, tajemství zaměstnavatele a reference lze často nahradit zástupnými symboly.

Můžu nahrávat rodinné dokumenty do AI?

Buďte opatrní. Lékařské dopisy, pasy, školní dokumenty, právní listiny, bankovní soubory a rodinné záznamy mohou obsahovat citlivá data o dalších lidech. Používejte schválená nastavení soukromí, nebo je nenahrávejte.

Stávají se soukromé prompty tréninkovými daty AI?

Záleží na produktu, typu účtu a nastavení. Někteří poskytovatelé nabízejí ovládací prvky, týmové plány nebo API podmínky, které nakládají s daty jinak. Než napíšete citlivé informace, zkontrolujte aktuální nastavení.

Můžu úplně zabránit firmám AI trénovat na mém webu?

Ne jedním technickým vypínačem. robots.txt může požádat crawlery dodržující pravidla, aby se držely stranou, ale je dobrovolný a neodstraní kopie, které už existují jinde.

Blokuje robots.txt trénink AI právně?

robots.txt je technická konvence, ne smlouva sama o sobě. Může podpořit vaše stanovisko, ale právní otázky závisí na jurisdikci, podmínkách, autorském právu, smlouvách a vymáhání.