Foton och bilder

Foton är också personuppgifter.

För personliga foton är crawler-blockering bara ett lager. Tänk på ansikten, barn, platsledtrådar, privata händelser, licensiering, autentisering, vattenstämplar, proveniens och plattformsinställningar.

Visuella tillgångar

Fotoskydd byggs i lager.

Privata foton

Var försiktig med barn, ansikten, hemmiljöer, händelser, dokument i bakgrunden, skoluniformer, registreringsskyltar och platsledtrådar. Offentliga bilder kan kopieras, så förlita dig inte på en enda kontroll.

Kreatörsportföljer

Använd tydliga licensvillkor, förhandsvisningar i lägre upplösning, autentiserade gallerier, vattenstämplar, proveniensmetadata och plattformsinställningar.

Hur scraping fungerar

Hur AI-bildinsamling faktiskt går till.

Att förstå processen hjälper dig att se var dina egna kontroller kan och inte kan nå. Mycket av detta är offentlig information om hur stora bilddataset historiskt har byggts, men exakta metoder skiljer sig mellan företag och förändras över tid, så betrakta detta som bakgrund snarare än en garanti.

Offentliga dataset och länklistor

Många träningsuppsättningar sattes samman från stora webbcrawlar (till exempel breda arkiv av offentliga sidor) och från listor med bild-URL:er kopplade till sin omgivande text. Om en bild ligger på en offentlig sida som en regelefterlevande crawler kan nå, kan den hamna refererad i ett sådant dataset. Att ta bort bilden senare tar inte nödvändigtvis bort kopior som redan samlats in.

Alt-text och bildtexter

Bildmodeller lär sig ofta av orden nära en bild: alt-attributet, bildtexter, filnamn och närliggande stycken. Beskrivande alt-text är bra för tillgänglighet och sökbarhet, men den gör också en bild lättare att märka och indexera. Detta är en avvägning, inte ett skäl att ta bort tillgänglighetstext.

EXIF och metadata

Foton kan bära EXIF-metadata som kameramodell, tidsstämplar och ibland GPS-koordinater. Många plattformar tar bort detta vid uppladdning, men inte alla gör det, och filer som delas direkt kan behålla det. Att ta bort plats- och identifierande metadata före publicering är en förnuftig vana, även om det inte påverkar det som syns i själva bilden.

Omvänd bildsökning och återuppladdningar

När en bild väl är offentlig kan andra ladda ner, återpublicera eller omvänt söka på den. Det betyder att samma bild kan dyka upp på sajter du inte kontrollerar, var och en med sina egna robots-regler. Det är därför ingen enskild inställning kan lova att en bild aldrig kommer att synas igen.

Verklighetskoll: dessa kontroller minskar exponeringen och signalerar din avsikt. De är frivilliga konventioner och ofullkomliga i praktiken. Inget här garanterar att en bild utesluts från varje dataset, och den här sidan är pedagogisk information, inte juridisk rådgivning.

Praktisk checklista

Privata foton kontra kreatörsportföljer.

För privata foton och familjefoton

Håll det privat: den starkaste kontrollen är att inte publicera känsliga foton offentligt alls. Använd slutna album eller betrodd delning i stället för öppna sidor.

Tänk på bakgrunden: dokument, skärmar, husnummer, uniformer, brickor och registreringsskyltar kan avslöja mer än motivet.

Ta bort metadata: ta bort GPS och identifierande EXIF innan du delar filer, särskilt bilder på barn.

Kontrollera plattformsinställningar: gå igenom vem som kan se, ladda ner eller indexera dina uppladdningar, och om plattformen erbjuder några AI- eller träningskontroller.

För kreatörsportföljer

Visa förhandsvisningar, inte original: publicera versioner i lägre upplösning eller med vattenstämpel och håll filer i full upplösning bakom en inloggning eller licens.

Ange licensiering tydligt: ett synligt uttalande om användning och licensiering stödjer din position, även om det inte i sig kan framtvinga efterlevnad.

Skydda gallerier: autentiserade gallerier eller gallerier enbart för kunder håller arbetet borta från öppna, crawlingsbara sidor.

Lägg försvaret i lager: kombinera robots-kontroller, proveniensmetadata och plattformsinställningar i stället för att förlita dig på en enda åtgärd.

Proveniens och verktyg

Vattenmärkning, proveniens och anti-scraping-verktyg.

Content Credentials (C2PA)

C2PA-standarden, som i vissa verktyg visas som Content Credentials, bifogar manipulationssäker proveniensmetadata som beskriver hur en bild skapades eller redigerades. Den hjälper andra att verifiera ursprung och kan signalera upphovsmannaskap, men den förhindrar inte fysiskt kopiering, och metadata kan tas bort. Stödet varierar mellan plattformar, så verifiera aktuellt beteende i dina verktyg.

Synliga och osynliga vattenstämplar

Synliga vattenstämplar avskräcker från slentrianmässig återanvändning; osynliga eller forensiska vattenstämplar kan hjälpa dig att spåra kopior senare. Ingendera hindrar en bild från att scrapas, och aggressiva vattenstämplar påverkar hur ditt verk ser ut, så väg avvägningen.

Anti-scraping-verktyg (med reservationer)

Forskningsverktyg som Glaze och Nightshade syftar till att lägga till subtila störningar som gör bilder svårare för vissa modeller att lära sig av eller som stör träningen. Effektiviteten varierar, är omdiskuterad och kan förändras när modeller utvecklas. Betrakta dem som experimentella extra lager, inte garanterat skydd, och läs den aktuella projektdokumentationen innan du förlitar dig på dem.

Plattformsinställningar

Var opt-out och kontroller vanligtvis finns.

Många foto- och kreativa plattformar har lagt till AI-relaterade inställningar, men namn, standardvärden och tillgänglighet ändras ofta och skiljer sig mellan regioner och kontotyper. Använd detta som en orientering, och bekräfta sedan de aktuella alternativen i varje plattforms egna integritets- eller kontosidor.

Var du ska tittaVad det kan styraFörsiktighetsnotering
Kontots integritetsinställningarOm inlägg och bilder är offentliga, och vem som kan ladda ner eller indexera demOffentligt innehåll kan fortfarande kopieras av andra när det väl har setts
AI- eller tredjepartsdatainställningarVissa plattformar erbjuder en brytare för att begränsa användningen av ditt innehåll för AI eller modellträningTillgänglighet och omfattning varierar; kan inte täcka tidigare insamling
Portfölj- och licensieringsalternativHögerklicksskydd, nedladdningsgränser, licensieringsetiketterDessa avskräcker från slentrianmässig återanvändning men är inte tillämpning
Robots- och webbplatskontroller (egen sajt)Att be regelefterlevande crawlers att hoppa över bildkatalogerFrivilligt; tar inte bort befintliga kopior på andra ställen

Inställningar och brytare flyttas och byter namn ofta. Verifiera de aktuella alternativen i varje leverantörs officiella hjälpsidor innan du antar att en kontroll finns eller täcker det du förväntar dig.

Relaterad läsning

Nästa steg.

ModelVersus modelversus.com

Jämför AI-modeller innan du väljer ett arbetsflöde.

ChatGPT Alternatives chatgpt-alternatives.com

Hitta neutrala alternativ när en enda AI-leverantör inte räcker.

AI Subscription Guide aisubscriptionguide.com

Lär dig vilket AI-abonnemang som passar ditt verkliga arbete.

OpenAI:s crawler-dokumentation platform.openai.com/docs/gptbot

Kontrollera OpenAI:s aktuella vägledning om crawlers och user agents.

Googles crawler-dokumentation developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Verifiera Googles crawlernamn, indexeringsbeteende och AI-relaterade kontroller.

Anthropic support support.anthropic.com/

Kontrollera aktuell vägledning om Claude-konto, data och crawlers.

FAQ

Vanliga tvivel.

Kan jag stoppa AI-träning på mina personliga foton?

Du kan minska exponeringen, men du kan inte garantera full kontroll när foton väl är offentliga. Håll känsliga foton privata, gå igenom plattformens inställningar, undvik offentliga uppladdningar i hög upplösning och använd crawler-kontroller för din egen webbplats.

Bör jag klistra in mitt CV i en AI-chatbot?

Bara efter att du tagit bort uppgifter du inte behöver för uppgiften. Namn, adresser, telefonnummer, födelsedatum, signaturer, arbetsgivarhemligheter och referenser kan ofta ersättas med platshållare.

Kan jag ladda upp familjedokument till AI?

Var försiktig. Läkarintyg, pass, skoldokument, juridiska handlingar, bankfiler och familjeregister kan innehålla känsliga uppgifter om andra människor. Använd godkända integritetsinställningar eller ladda inte upp dem.

Blir privata prompter till AI-träningsdata?

Det beror på produkten, kontotypen och inställningarna. Vissa leverantörer erbjuder kontroller, team-abonnemang eller API-villkor som hanterar data annorlunda. Kontrollera de aktuella inställningarna innan du skriver in känslig information.

Kan jag helt stoppa AI-företag från att träna på min webbplats?

Inte med en enda teknisk brytare. robots.txt kan begära att regelefterlevande crawlers håller sig borta, men det är frivilligt och tar inte bort kopior som redan finns på andra ställen.

Blockerar robots.txt AI-träning juridiskt?

robots.txt är en teknisk konvention, inte ett avtal i sig. Den kan stödja din policyståndpunkt, men juridiska frågor beror på jurisdiktion, villkor, upphovsrätt, avtal och tillämpning.