Mina prompter
Klistra inte in namn, adresser, lösenord, hälsouppgifter, juridiska problem, barns information eller konfidentiell arbetsdata om inte verktyget och kontot är godkända för den användningen.
Guide för privatpersoner
Detta är i första hand för vanliga människor: din blogg, dina foton, ditt CV, familjedokument, privata anteckningar, skolarbete, klientfiler, sociala inlägg och prompter. Lär dig vad du kan blockera, vad du bara kan minska och vad du aldrig bör ladda upp utan att tänka efter.
Snabbt svar
Det säkraste draget är inte enbart en crawler-blockering. Det handlar om att veta vad man inte ska publicera, vad man inte ska klistra in, vilka kontoinställningar man ska kontrollera och när en fil helt bör hållas utanför AI-verktyg.
Klistra inte in namn, adresser, lösenord, hälsouppgifter, juridiska problem, barns information eller konfidentiell arbetsdata om inte verktyget och kontot är godkända för den användningen.
Redigera bort uppgifter i CV:n, avtal, bankfiler, läkarintyg, skoldokument och klient-PDF:er. Om uppgifterna tillhör någon annan, behandla dem som högre risk.
Offentliga foton kan innehålla ansikten, platser, namn, registreringsskyltar och privata händelser. Håll känsliga album privata och tänk efter innan du laddar upp bilder till AI-verktyg.
Om du driver en blogg eller portfölj kan robots.txt och serverregler begära att regelefterlevande AI-crawlers håller sig borta. De raderar inte gamla kopior.
Checklista för privatpersoner
Ställ dessa frågor innan du laddar upp eller klistrar in något. Om ett svar känns obekvämt, använd platshållare, ta bort filen eller använd ett mer kontrollerat konto.
Identifierar detta mig? Namn, adress, telefon, e-post, signatur, födelsedag, passnummer, ansikte, röst eller exakt plats.
Identifierar det någon annan? Barn, partner, kund, patient, elev, kollega, hyresgäst, anställd eller klient.
Skulle jag publicera det online? Om nej, behandla inte en slumpmässig AI-prompt som ett säkert privat anteckningsblock.
Kan jag ersätta detaljer? Använd ”Person A”, ”Företag B”, påhittade datum, breda platser och förkortade utdrag när den exakta datan inte behövs.
Känner jag till kontoinställningarna? Konsument-, team-, API- och enterprise-konton kan hantera data olika. Kontrollera aktuella inställningar.
Tekniska lager
Använd robots.txt, serverloggar, brandväggsregler och en synlig innehållspolicy. Detta minskar regelefterlevande crawling men tar inte bort gamla kopior eller stoppar illasinnade aktörer.
Använd leverantörens datakontroller, inställningar för chatthistorik, team-abonnemang, API-villkor, lagringsalternativ och opt-outs. Detta är separat från crawler-blockering.
Använd klientens tillstånd, företagspolicy, redigering, godkända verktyg och åtkomstkontroll innan du laddar upp kundfiler, HR-uppgifter eller konfidentiella dokument.
Beslutskarta
Börja på den plats där dina data blir tillgängliga. En prompt, en offentlig blogg, en privat PDF, ett fotoalbum, en molnlagring och ett arbetsdokument är olika riskytor.
En nyttig integritetsvana är tråkig men kraftfull: ladda upp mindre, redigera bort mer, håll privata album privata, kontrollera inställningar och använd crawler-blockeringar bara där de passar.
Crawler-matris
| User agent | Företag | Varför det spelar roll | Försiktighetsnotering |
|---|---|---|---|
GPTBot | OpenAI | Används ofta för OpenAI:s webbcrawling-kontroller. | Blockera om du inte vill att denna crawler hämtar dina offentliga sidor för AI-relaterad användning. Verifiera aktuell OpenAI-dokumentation. |
ChatGPT-User | OpenAI | Användarutlöst surf-/hämtningsagent i många diskussioner. | Att blockera den kan hindra ChatGPT-användare från att be den läsa din sida. Detta har inte samma avsikt som bred träningscrawling. |
Google-Extended | En kontroll som Google dokumenterar för vissa generativa AI-användningsfall. | Detta är inte samma sak som att blockera Google Sök. Blockera inte Googlebot om du inte vill påverka sökbarheten. | |
ClaudeBot | Anthropic | Anthropic-crawlernamn som setts i diskussioner om crawler-kontroll. | Använd endast efter att ha kontrollerat Anthropics senaste dokumentation. |
Claude-SearchBot | Anthropic | Sökrelaterat Claude-crawlernamn som setts i offentlig vägledning. | Överväg synlighetsavvägningen innan du blockerar söktypsagenter. |
PerplexityBot | Perplexity | Perplexity-crawler/user-agent som diskuterats av publicister. | Att blockera kan påverka hur ditt innehåll upptäcks eller citeras av Perplexity-liknande svarsmotorer. |
CCBot | Common Crawl | Offentlig webbcrawler som används för stora webbdataset. | Blockeras ofta av publicister som inte vill att sidor kopieras till offentliga crawl-korpusar. |
Bytespider | ByteDance | Crawler förknippad med ByteDance. | Bra att gå igenom om du vill ha en bred blockeringslista för AI-crawlers. |
Statiskt verktyg
Välj de crawlers du vill begära att inte crawla. Denna generator körs endast i din webbläsare. Den skickar inga data någonstans. Verifiera de aktuella officiella user-agent-namnen innan du driftsätter.
# AI-crawler-kontroller: verifiera aktuella user-agent-namn innan driftsättning.
# Detta är frivilligt. robots.txt är inte ett juridiskt lås.
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: PerplexityBot
Disallow: /
User-agent: CCBot
Disallow: /
Varning: att blockera användarutlösta eller sökrelaterade agenter kan minska AI-assisterad upptäckt, förhandsvisningar eller källhänvisningar.
Officiella referenser
Kontrollera OpenAI:s aktuella vägledning om crawlers och user agents.
Googles crawler-dokumentation developers.google.com/search/docs/crawling-indexing/overview-google-crawlersVerifiera Googles crawlernamn, indexeringsbeteende och AI-relaterade kontroller.
Anthropic support support.anthropic.com/Kontrollera aktuell vägledning om Claude-konto, data och crawlers.
Perplexity www.perplexity.ai/Gå igenom aktuell produkt- och publicistinformation från Perplexity.
Common Crawl commoncrawl.org/Förstå ett stort offentligt webbcrawl-dataset som används inom forskning.
Robots Exclusion Protocol www.rfc-editor.org/rfc/rfc9309Den formella referensen för robots.txt-protokollet.
Relaterade guider
Jämför AI-modeller innan du väljer ett arbetsflöde.
ChatGPT Alternatives chatgpt-alternatives.comHitta neutrala alternativ när en enda AI-leverantör inte räcker.
AI Subscription Guide aisubscriptionguide.comLär dig vilket AI-abonnemang som passar ditt verkliga arbete.
KIWerkzeuge kiwerkzeuge.comTysk katalog över AI-verktyg och integritetsfokuserade guider för AI-verktyg.
BoiteAIA boiteaia.comFransk katalog över AI-verktyg för chatbottar, bildverktyg och företagsanvändning.
MultipleChat AI multiplechat.aiAnvänd flera AI-modeller i ett gränssnitt och håll arbetsflöden åtskilda per projekt.
FAQ
Du kan minska exponeringen, men du kan inte garantera full kontroll när foton väl är offentliga. Håll känsliga foton privata, gå igenom plattformens inställningar, undvik offentliga uppladdningar i hög upplösning och använd crawler-kontroller för din egen webbplats.
Bara efter att du tagit bort uppgifter du inte behöver för uppgiften. Namn, adresser, telefonnummer, födelsedatum, signaturer, arbetsgivarhemligheter och referenser kan ofta ersättas med platshållare.
Var försiktig. Läkarintyg, pass, skoldokument, juridiska handlingar, bankfiler och familjeregister kan innehålla känsliga uppgifter om andra människor. Använd godkända integritetsinställningar eller ladda inte upp dem.
Det beror på produkten, kontotypen och inställningarna. Vissa leverantörer erbjuder kontroller, team-abonnemang eller API-villkor som hanterar data annorlunda. Kontrollera de aktuella inställningarna innan du skriver in känslig information.
Inte med en enda teknisk brytare. robots.txt kan begära att regelefterlevande crawlers håller sig borta, men det är frivilligt och tar inte bort kopior som redan finns på andra ställen.
robots.txt är en teknisk konvention, inte ett avtal i sig. Den kan stödja din policyståndpunkt, men juridiska frågor beror på jurisdiktion, villkor, upphovsrätt, avtal och tillämpning.
Att blockera AI-specifika agenter bör inte behandlas på samma sätt som att blockera Googlebot. Om du blockerar vanliga sökcrawlers kan sökbarheten skadas. Kontrollera varje user agent noga.
Bara om du förstår avvägningen. Användarutlösta agenter kan hämta sidor när en person ber ett AI-verktyg att läsa din webbplats. Att blockera dem kan minska AI-assisterad upptäckt.