Meritförteckning eller CV
Ta bort telefon, gatuadress, födelsedag, signatur och referenser. Be om struktur, ton och formulering med hjälp av platshållare.
För privatpersoner
De flesta misstag kring AI-integritet sker i det tysta: ett inskannat pass i en prompt, ett barns foto på en offentlig sida, ett CV inklistrat i en chatbot, eller privata anteckningar uppladdade för att sammanfattas. Den här sidan hjälper dig att avgöra vad som är okej, vad som behöver maskeras och vad som bör förbli offline.
Personlig riskkarta
AI-integritet brister ofta i vardagliga stunder: att be en chatbot skriva om ett klagomålsbrev med din fullständiga adress, att ladda upp en medicinsk PDF för att sammanfatta den, att klistra in ett kundmejl, eller att förvandla ett barns foto till en AI-bild. Frågan är inte bara ”kommer detta att träna en modell?” Den är ”ska denna data alls lämna mina händer?”
Crawler-regler hjälper offentliga sidor. De skyddar inte en privat fil som du frivilligt klistrar in i ett verktyg. För privatpersoner är den starkaste kontrollen att välja vad som förblir lokalt.
Praktiska exempel
Ta bort telefon, gatuadress, födelsedag, signatur och referenser. Be om struktur, ton och formulering med hjälp av platshållare.
Ladda inte upp hela filen slentrianmässigt. Om du behöver hjälp med enkelt språk, ta först bort namn, datum, kliniknummer och identifierande detaljer.
Ladda inte upp ansikten, barn, hemmiljöer eller platsrika foton om du inte känner dig bekväm med leverantören och produktanvändningen.
Ersätt kundnamn, projektnamn, priser och interna konfliktdetaljer. Håll frågan generisk där det är möjligt.
Vad räknas som personuppgifter
När människor föreställer sig AI-träning tänker de sig oftast ett företag som avsiktligt kopierar ett dokument. I praktiken tenderar personlig information att anlända via många små, vardagliga kanaler på en gång. Att förstå de kanalerna hjälper dig att avgöra var din uppmärksamhet faktiskt är värd att lägga. Inget av detta är juridisk rådgivning, och det exakta beteendet hos varje leverantör förändras över tid, så behandla beskrivningarna nedan som en generell karta snarare än en garanti.
Text du skriver in i en chatbot, inklusive följdfrågor, är data. Beroende på produkt, kontotyp och inställningar kan en del av den behållas, granskas av människor för kvalitet, eller användas för att förbättra modeller. Standardinställningar för konsumenter och villkor för företag eller API skiljer sig ofta åt. Verifiera de aktuella inställningarna för det specifika verktyg du använder.
Filer du bifogar, såsom PDF:er, kalkylark, skärmbilder och bilder, bearbetas av leverantören. En enda uppladdning kan innehålla långt mer än du avser, inklusive metadata, dolda kolumner, kommentarer och platstaggar inbäddade i foton.
Allt som är synligt på det öppna webben, inklusive sociala profiler inställda på offentliga, forumkommentarer, recensioner och personliga webbplatser, kan hämtas av crawlers. När innehåll väl är offentligt och kopierat tar en senare radering inte tillförlitligt bort varenda cachad kopia på andra ställen.
Offentliga foton, biografier, bildtexter och kontakter på sociala plattformar kan samlas in i stor skala. Plattformars inställningar och villkor varierar, och åtgärder mot oönskad skrapning är inkonsekventa, så en ”offentlig” inställning bör helst behandlas som ”potentiellt insamlad”.
Mäklare sätter samman profiler från offentliga register, köp, apptillstånd och andra källor, och säljer dem sedan vidare. Denna data kan mata efterföljande system. Du valde ofta inte att listas, vilket är varför opt-out-förfrågningar spelar roll även om de är ofullständiga och långsamma.
Andra människor kan också exponera din data: en vän taggar ett foto, en kollega klistrar in en mejltråd som innehåller din adress, eller en familjemedlem laddar upp ett delat dokument. Du kan inte helt kontrollera vad andra gör, men du kan minska vad du själv bidrar med.
Din exponering är ungefär summan av vad du laddar upp, vad du publicerar och vad andra publicerar om dig. Du har mest kontroll över det första, meningsfull kontroll över det andra, och endast delvis inflytande över det tredje. Lägg din möda i den ordningen.
Minska din exponering
Du behöver inte göra allt på en gång. Behandla listan nedan som en meny, inte ett påbud. Varje punkt sänker exponeringen en aning; ingen av dem gör dig osynlig, och det är en ärlig begränsning snarare än ett misslyckande i tillvägagångssättet.
Konsumentstandarder skiljer sig
Leverantörer intar olika ståndpunkter om huruvida konsumenters indata används för att förbättra modeller, och dessa ståndpunkter skiftar med policyuppdateringar, produktnivåer och regioner. Tabellen nedan beskriver de typer av skillnader du kan stöta på. Den är medvetet generell och är inte ett aktuellt uttalande om någon specifik leverantör. Bekräfta alltid mot den officiella dokumentationen och inställningarna i produkten innan du förlitar dig på något av det, eftersom detta är precis den sortens detalj som ändras utan större förvarning.
| Faktor | Vad det kan betyda | Hur du kontrollerar |
|---|---|---|
| Kontotyp | Gratis-, personliga betal-, team- och företagsabonnemang kan styras av olika datavillkor. | Läs de villkor som är knutna till exakt ditt abonnemang, inte en allmän marknadsföringssida. |
| Standard för träning | Vissa produkter använder konsumenters indata för att förbättra modeller som standard; andra gör det inte, eller kräver aktivt samtycke. | Leta efter en inställning för datakontroller eller integritet inne i appen. |
| Tillgång till opt-out | En opt-out kan finnas, kan vara begränsad till vissa regioner, eller kanske inte gäller retroaktivt. | Bekräfta om inställningen påverkar tidigare data eller endast framtida indata. |
| API kontra app | API- och utvecklarvillkor behandlar ofta data annorlunda än konsumentchattappen. | Kontrollera policyn för dataanvändning i API:et separat från apppolicyn. |
| Mänsklig granskning | Indata kan granskas av människor för säkerhet eller kvalitet, skilt från modellträning. | Läs hur leverantören beskriver granskning, lagring och personalåtkomst. |
Det säkraste antagandet är att allt du inte skulle vilja se behållet inte bör skrivas eller laddas upp överhuvudtaget. Inställningar hjälper, men de är bara så tillförlitliga som din förståelse av dem den dag du använder verktyget.
Maskera innan du klistrar in
Maskering handlar inte om paranoia; det handlar om att ge verktyget endast det som uppgiften kräver. En väl anonymiserad prompt ger vanligtvis ett lika bra svar, eftersom modellen sällan behöver din riktiga adress för att rätta en mening. Nedan är ett enkelt före-och-efter-mönster som du kan anpassa.
Före:
"Skriv om detta: Käre Dr. Meier, angående min son Leon Muller,
patient-ID 44-8821 på Zurich Clinic, tid den 12 mars..."
Efter:
"Skriv om detta i en artig, formell ton: Käre [LÄKARE], angående
mitt barn [NAMN], patient-ID [ID] på [KLINIK], tid den [DATUM]..."Ersätt riktiga namn med [NAMN] eller en roll såsom [BARN] eller [CHEF]. Den formuleringshjälp du vill ha beror nästan aldrig på det faktiska namnet.
Byt ut kontonummer, patient-ID:n, telefonnummer och födelsedatum mot platshållare. Om det exakta numret spelar roll för en beräkning, överväg att göra den delen offline.
Beskär bort signaturer, brevhuvuden och referensnummer. För foton, ta bort platsmetadata och undvik bakgrunder som avslöjar var du bor eller arbetar.
Inget av detta garanterar anonymitet, eftersom sammanhang ibland kan återidentifiera en person även utan ett namn. Det tar dock bort de mest uppenbara och mest skadliga identifierarna, vilket är ett rimligt och uppnåeligt mål för vardagligt bruk.
Gammalt innehåll och opt-outs
Att minska framtida exponering är enklare än att städa upp det förflutna, men det förflutna spelar fortfarande roll. Det här avsnittet täcker realistiska, om än ofullkomliga, sätt att minska det som redan cirkulerar. Räkna med delvisa resultat, förseningar och att borttaget innehåll då och då dyker upp igen, eftersom det är den ärliga naturen hos detta arbete.
Även en perfekt borttagningsinsats kan inte återkalla kopior som redan cachades, arkiverades eller skrapades innan du agerade. Opt-outs och robots.txt är frivilliga konventioner som många, men inte alla, aktörer respekterar. Behandla dem som skademinimering, inte som radering.
Myter mot verklighet
Självsäkert klingande råd sprids snabbt på nätet, och en del av det är vilseledande. Paren nedan skiljer några vanliga myter från en mer noggrann läsning. Som alltid är detta pedagogisk vägledning snarare än juridisk rådgivning.
Verklighet: radering kan ta bort originalet, men kopior kan kvarstå i cachar, arkiv och dataset som samlats in tidigare. Att radera tidigare är ändå bättre än senare, eftersom det begränsar hur länge innehållet var tillgängligt att kopiera.
Verklighet: det finns ingen universell brytare. Appinställningar, webbplatsers crawler-kontroller och opt-outs hos mäklare är separata lager, vart och ett ofullständigt. Att minska exponeringen innebär att kombinera flera av dem.
Verklighet: att markera ett konto som privat hjälper, men skärmbilder, vidaredelningar och tidigare offentliga perioder kan lämna spår. Behandla ”privat” som att minska, inte eliminera, exponering.
Verklighet: robots.txt är en frivillig teknisk konvention. Den kan uttrycka din preferens och stödja en policyståndpunkt, men den är inte i sig ett avtal, och efterlevnad är inte universell. Juridiska frågor beror på jurisdiktion och specifika fakta.
Verklighet: andra kan också publicera din data. Att hantera dina egna uppladdningar är nödvändigt men inte tillräckligt, vilket är varför borttagning vid källan och opt-outs hos mäklare också hör hemma i planen.
Verklighet: vissa betal- eller företagsnivåer erbjuder faktiskt starkare datavillkor, men detta är inte automatiskt. Bekräfta villkoren för ditt specifika abonnemang i stället för att anta att betalning ändrar standarden.
Relaterad läsning
Jämför AI-modeller innan du väljer ett arbetsflöde.
ChatGPT Alternatives chatgpt-alternatives.comHitta neutrala alternativ när en enda AI-leverantör inte räcker.
AI Subscription Guide aisubscriptionguide.comLär dig vilket AI-abonnemang som passar ditt verkliga arbete.
OpenAI:s crawler-dokumentation platform.openai.com/docs/gptbotKontrollera OpenAI:s aktuella vägledning om crawlers och user agents.
Googles crawler-dokumentation developers.google.com/search/docs/crawling-indexing/overview-google-crawlersVerifiera Googles crawlernamn, indexeringsbeteende och AI-relaterade kontroller.
Anthropic support support.anthropic.com/Kontrollera aktuell vägledning om Claude-konto, data och crawlers.
FAQ
Du kan minska exponeringen, men du kan inte garantera full kontroll när foton väl är offentliga. Håll känsliga foton privata, gå igenom plattformens inställningar, undvik offentliga uppladdningar i hög upplösning och använd crawler-kontroller för din egen webbplats.
Bara efter att du tagit bort uppgifter du inte behöver för uppgiften. Namn, adresser, telefonnummer, födelsedatum, signaturer, arbetsgivarhemligheter och referenser kan ofta ersättas med platshållare.
Var försiktig. Läkarintyg, pass, skoldokument, juridiska handlingar, bankfiler och familjeregister kan innehålla känsliga uppgifter om andra människor. Använd godkända integritetsinställningar eller ladda inte upp dem.
Det beror på produkten, kontotypen och inställningarna. Vissa leverantörer erbjuder kontroller, team-abonnemang eller API-villkor som hanterar data annorlunda. Kontrollera de aktuella inställningarna innan du skriver in känslig information.
Inte med en enda teknisk brytare. robots.txt kan begära att regelefterlevande crawlers håller sig borta, men det är frivilligt och tar inte bort kopior som redan finns på andra ställen.
robots.txt är en teknisk konvention, inte ett avtal i sig. Den kan stödja din policyståndpunkt, men juridiska frågor beror på jurisdiktion, villkor, upphovsrätt, avtal och tillämpning.