Per i privati

La privacy personale con l'IA inizia prima di caricare.

La maggior parte degli errori sulla privacy con l'IA avviene in silenzio: un passaporto scansionato in un prompt, la foto di un bambino su una pagina pubblica, un CV incollato in un chatbot o note private caricate per essere riassunte. Questa pagina ti aiuta a decidere cosa va bene, cosa va oscurato e cosa dovrebbe restare offline.

Mappa dei rischi personali

La maggior parte delle persone non ha bisogno prima di una teoria legale. Ha bisogno di regole per i caricamenti.

La privacy con l'IA spesso fallisce in momenti ordinari: chiedere a un chatbot di riscrivere una lettera di reclamo con il tuo indirizzo completo, caricare un PDF medico per riassumerlo, incollare l'e-mail di un cliente o trasformare la foto di un bambino in un'immagine generata dall'IA. La domanda non è solo "questo addestrerà un modello?". È "questi dati dovrebbero davvero uscire dalle mie mani?".

  1. Verde: fatti pubblici, esempi generici, testi che avevi già intenzione di pubblicare, bozze anonimizzate.
  2. Giallo: CV, lavori scolastici, lettere personali, foto senza contesto sensibile, bozze di lavoro dopo l'oscuramento.
  3. Rosso: documenti d'identità, documenti bancari, cartelle cliniche, controversie legali, password, foto private di bambini, dati dei clienti e tutto ciò che non hai il permesso di condividere.

Il blocco migliore è non caricare.

Le regole per i crawler aiutano le pagine pubbliche. Non proteggono un file privato che incolli volontariamente in uno strumento. Per i privati, il controllo più forte è scegliere cosa resta in locale.

Esempi pratici

Come usare l'IA senza condividere troppo.

Curriculum o CV

Rimuovi telefono, indirizzo, data di nascita, firma e referenze. Chiedi struttura, tono e formulazione usando dei segnaposto.

Lettera medica

Non caricare l'intero file con leggerezza. Se ti serve un aiuto in linguaggio semplice, rimuovi prima nomi, date, numeri della clinica e dettagli identificativi.

Foto di famiglia

Non caricare volti, bambini, interni di casa o foto ricche di indicazioni sul luogo, a meno che tu non ti senta a tuo agio con il fornitore e l'uso del prodotto.

E-mail di lavoro

Sostituisci nomi dei clienti, nomi dei progetti, prezzi e dettagli di conflitti interni. Mantieni la domanda generica dove possibile.

Cosa conta come dato personale

I dati personali raggiungono i sistemi di IA attraverso più vie di quante la maggior parte delle persone immagini.

Quando le persone immaginano l'addestramento dell'IA, di solito pensano a un'azienda che copia deliberatamente un documento. In pratica, le informazioni personali tendono ad arrivare attraverso molti piccoli canali ordinari tutti insieme. Comprendere questi canali ti aiuta a decidere dove vale davvero la pena concentrare la tua attenzione. Nulla di tutto ciò è una consulenza legale, e il comportamento esatto di ogni fornitore cambia nel tempo, quindi tratta le descrizioni seguenti come una mappa generale più che come una garanzia.

Prompt e cronologia delle chat

Il testo che digiti in un chatbot, comprese le domande di follow-up, è un dato. A seconda del prodotto, del tipo di account e delle impostazioni, una parte di esso può essere conservata, esaminata da persone per la qualità o usata per migliorare i modelli. Le impostazioni predefinite per i consumatori e i termini per le aziende o le API spesso differiscono. Verifica le impostazioni attuali dello strumento specifico che utilizzi.

Caricamenti e allegati

I file che alleghi, come PDF, fogli di calcolo, screenshot e immagini, vengono elaborati dal fornitore. Un singolo caricamento può contenere molto più di quanto intendi, inclusi metadati, colonne nascoste, commenti e tag di localizzazione incorporati nelle foto.

Post e pagine pubbliche

Tutto ciò che è visibile sul web aperto, inclusi i profili social impostati come pubblici, i commenti nei forum, le recensioni e i siti web personali, può essere recuperato dai crawler. Una volta che un contenuto è pubblico e copiato, una successiva cancellazione non rimuove in modo affidabile ogni copia memorizzata nella cache altrove.

Profili social estratti

Foto pubbliche, biografie, didascalie e connessioni sulle piattaforme social possono essere raccolte su larga scala. Le impostazioni e i termini delle piattaforme variano, e l'applicazione delle regole contro lo scraping indesiderato è incoerente, quindi un'impostazione "pubblica" è meglio considerarla come "potenzialmente raccolta".

Data broker

I broker assemblano profili a partire da registri pubblici, acquisti, permessi delle app e altre fonti, poi li rivendono. Questi dati possono alimentare sistemi a valle. Spesso non hai scelto tu di essere elencato, ed è per questo che le richieste di opt-out contano, anche se sono parziali e lente.

Condivisione da parte di terzi

Anche altre persone possono esporre i tuoi dati: un amico tagga una foto, un collega incolla un thread di e-mail che include il tuo indirizzo, o un familiare carica un documento condiviso. Non puoi controllare del tutto ciò che fanno gli altri, ma puoi ridurre ciò che contribuisci tu.

Un modello mentale utile.

La tua esposizione è all'incirca la somma di ciò che carichi, di ciò che pubblichi e di ciò che altri pubblicano su di te. Hai il massimo controllo sulla prima, un controllo significativo sulla seconda e solo un'influenza parziale sulla terza. Investi il tuo impegno in quest'ordine.

Riduci la tua esposizione

Una checklist pratica che puoi completare in un pomeriggio.

Non devi fare tutto in una volta. Considera l'elenco seguente come un menu, non come un obbligo. Ogni voce abbassa un po' l'esposizione; nessuna di esse ti rende invisibile, e questo è un limite onesto piuttosto che un fallimento dell'approccio.

Le impostazioni predefinite per i consumatori differiscono

Come le impostazioni predefinite dell'addestramento IA per i consumatori variano da fornitore a fornitore, e perché devi verificare.

I fornitori assumono posizioni diverse sul fatto che gli input dei consumatori vengano usati per migliorare i modelli, e queste posizioni cambiano con gli aggiornamenti delle policy, i livelli di prodotto e le regioni. La tabella seguente descrive i tipi di differenze che potresti incontrare. È volutamente generica e non è un'affermazione attuale su alcun fornitore specifico. Conferma sempre confrontando con la documentazione ufficiale e le impostazioni nel prodotto prima di fare affidamento su una qualsiasi di esse, perché questo è esattamente il tipo di dettaglio che cambia senza troppo preavviso.

FattoreCosa può significareCome verificare
Tipo di accountI piani gratuiti, personali a pagamento, di team ed enterprise possono essere regolati da termini sui dati diversi.Leggi i termini legati al tuo piano esatto, non una pagina di marketing generica.
Impostazione predefinita di addestramentoAlcuni prodotti usano gli input dei consumatori per migliorare i modelli in modo predefinito; altri no, o richiedono l'opt-in.Cerca un'impostazione sui controlli dei dati o sulla privacy all'interno dell'app.
Disponibilità dell'opt-outUn opt-out può esistere, essere limitato a determinate regioni o non applicarsi retroattivamente.Conferma se l'impostazione riguarda i dati passati o solo gli input futuri.
API vs appI termini per API e sviluppatori spesso trattano i dati in modo diverso rispetto all'app di chat per i consumatori.Controlla la policy sull'uso dei dati delle API separatamente da quella dell'app.
Revisione umanaGli input possono essere esaminati da persone per motivi di sicurezza o qualità, distinti dall'addestramento del modello.Leggi come il fornitore descrive revisione, conservazione e accesso del personale.

Verifica, non dare per scontato.

L'assunzione più sicura è che qualsiasi cosa tu non vorresti veder conservata non dovrebbe essere digitata o caricata in primo luogo. Le impostazioni aiutano, ma sono affidabili solo quanto la tua comprensione di esse nel giorno in cui usi lo strumento.

Oscura prima di incollare

Anonimizzare i contenuti è la singola abitudine di maggior valore.

L'oscuramento non riguarda la paranoia; riguarda il dare allo strumento solo ciò che il compito richiede. Un prompt ben anonimizzato di solito produce una risposta altrettanto buona, perché il modello raramente ha bisogno del tuo vero indirizzo per correggere una frase. Di seguito trovi un semplice schema prima-e-dopo che puoi adattare.

Prima:
"Riscrivi questo: Gentile Dott. Meier, riguardo a mio figlio Leon Muller,
ID paziente 44-8821 presso la Clinica di Zurigo, appuntamento il 12 marzo..."

Dopo:
"Riscrivi questo in un tono cortese e formale: Gentile [MEDICO], riguardo
a mio figlio/a [NOME], ID paziente [ID] presso la [CLINICA], appuntamento il [DATA]..."

Nomi e relazioni

Sostituisci i nomi reali con [NOME] o un ruolo come [FIGLIO] o [RESPONSABILE]. L'aiuto sulla formulazione che desideri non dipende quasi mai dal nome reale.

Numeri e documenti d'identità

Scambia numeri di conto, ID paziente, numeri di telefono e date di nascita con dei segnaposto. Se il numero esatto è importante per un calcolo, valuta di svolgere quella parte offline.

File e immagini

Ritaglia firme, intestazioni e numeri di riferimento. Per le foto, rimuovi i metadati di localizzazione ed evita sfondi che rivelino dove abiti o lavori.

Nulla di tutto ciò garantisce l'anonimato, poiché il contesto a volte può re-identificare una persona anche senza un nome. Rimuove però gli identificatori più evidenti e più dannosi, il che è un obiettivo ragionevole e raggiungibile per l'uso quotidiano.

Vecchi contenuti e opt-out

Gestire ciò che è già pubblico: risultati di ricerca e data broker.

Ridurre l'esposizione futura è più facile che ripulire il passato, ma il passato conta comunque. Questa sezione tratta modi realistici, seppur imperfetti, per ridurre ciò che è già in circolazione. Aspettati risultati parziali, ritardi e l'occasionale ricomparsa di contenuti rimossi, perché questa è la natura onesta di questo lavoro.

  1. Inventario: cerca il tuo nome, i tuoi nomi utente e i tuoi indirizzi e-mail per vedere cosa è indicizzato pubblicamente. Annota prima le voci a più alto rischio, come indirizzo di casa, numero di telefono o foto sensibili.
  2. Prima la fonte: dove possibile, rimuovi o rendi privati i contenuti alla fonte originale, come un vecchio profilo o un post in un forum, invece di rincorrere soltanto i risultati di ricerca.
  3. Rimozione dalla ricerca: i principali motori di ricerca offrono strumenti per richieste di rimozione di determinate informazioni personali sensibili. Questi influiscono sulla visibilità nella ricerca, non sulla pagina sottostante, e i criteri variano da regione a regione.
  4. Opt-out presso i broker: invia richieste di rimozione ai maggiori data broker e ai siti di ricerca di persone. Molti richiedono richieste ripetute nel tempo, e alcuni fanno pagare o rendono il processo volutamente laborioso.
  5. Manutieni: ricontrolla ogni pochi mesi. Gli opt-out possono decadere, e i profili possono essere ricostruiti da nuovi dati pubblici.

Un limite importante.

Anche uno sforzo di rimozione perfetto non può richiamare le copie che erano già state memorizzate nella cache, archiviate o estratte prima che agissi. Gli opt-out e robots.txt sono convenzioni volontarie che molti, ma non tutti, gli attori rispettano. Trattali come riduzione del danno, non come cancellazione.

Miti e realtà

Chiarire i malintesi comuni.

I consigli dal suono sicuro circolano rapidamente online, e alcuni di essi sono fuorvianti. Le coppie seguenti separano alcuni miti comuni da una lettura più attenta. Come sempre, si tratta di una guida educativa e non di una consulenza legale.

Mito: eliminare un post lo rimuove ovunque

Realtà: l'eliminazione può rimuovere l'originale, ma le copie possono persistere in cache, archivi e set di dati raccolti in precedenza. Eliminare prima è comunque meglio che dopo, poiché limita per quanto tempo il contenuto è stato disponibile per essere copiato.

Mito: una singola impostazione ferma tutto l'addestramento dell'IA

Realtà: non esiste un interruttore universale. Le impostazioni delle app, i controlli dei crawler del sito web e gli opt-out presso i broker sono livelli separati, ciascuno parziale. Ridurre l'esposizione significa combinarne diversi.

Mito: privato significa invisibile

Realtà: contrassegnare un account come privato aiuta, ma screenshot, ricondivisioni e precedenti periodi pubblici possono lasciare tracce. Tratta "privato" come una riduzione, non un'eliminazione, dell'esposizione.

Mito: robots.txt vieta legalmente l'addestramento

Realtà: robots.txt è una convenzione tecnica volontaria. Può esprimere la tua preferenza e sostenere una posizione di policy, ma di per sé non è un contratto, e la conformità non è universale. Le questioni legali dipendono dalla giurisdizione e dai fatti specifici.

Mito: conta solo ciò che carichi

Realtà: anche altri possono pubblicare i tuoi dati. Gestire i propri caricamenti è necessario ma non sufficiente, ed è per questo che anche la rimozione alla fonte e gli opt-out presso i broker fanno parte del piano.

Mito: gli strumenti a pagamento non si addestrano mai su di te

Realtà: alcuni livelli a pagamento o aziendali offrono termini sui dati più rigorosi, ma non è automatico. Conferma i termini per il tuo piano specifico, invece di dare per scontato che pagare cambi l'impostazione predefinita.

Letture correlate

Prossimi passi.

ModelVersus modelversus.com

Confronta i modelli di IA prima di scegliere un flusso di lavoro.

ChatGPT Alternatives chatgpt-alternatives.com

Trova alternative neutrali quando un solo fornitore di IA non basta.

AI Subscription Guide aisubscriptionguide.com

Scopri quale abbonamento IA si adatta al tuo lavoro reale.

Documentazione crawler OpenAI platform.openai.com/docs/gptbot

Controlla le indicazioni attuali di OpenAI su crawler e user-agent.

Documentazione crawler Google developers.google.com/search/docs/crawling-indexing/overview-google-crawlers

Verifica i nomi dei crawler di Google, il comportamento di indicizzazione e i controlli relativi all'IA.

Supporto Anthropic support.anthropic.com/

Controlla le indicazioni attuali su account Claude, dati e crawler.

FAQ

Dubbi comuni.

Posso impedire l'addestramento dell'IA sulle mie foto personali?

Puoi ridurre l'esposizione, ma non puoi garantire il pieno controllo una volta che le foto sono pubbliche. Mantieni private le foto sensibili, controlla le impostazioni della piattaforma, evita caricamenti pubblici ad alta risoluzione e usa i controlli per i crawler sul tuo sito web.

Dovrei incollare il mio CV o curriculum in un chatbot di IA?

Solo dopo aver rimosso i dettagli che non ti servono per il compito. Nomi, indirizzi, numeri di telefono, date di nascita, firme, segreti del datore di lavoro e referenze possono spesso essere sostituiti con dei segnaposto.

Posso caricare documenti di famiglia sull'IA?

Fai attenzione. Lettere mediche, passaporti, documenti scolastici, atti legali, file bancari e documenti di famiglia possono contenere dati sensibili su altre persone. Usa impostazioni sulla privacy approvate oppure non caricarli.

I prompt privati diventano dati per l'addestramento dell'IA?

Dipende dal prodotto, dal tipo di account e dalle impostazioni. Alcuni fornitori offrono controlli, piani di team o termini API che trattano i dati in modo diverso. Controlla le impostazioni attuali prima di digitare informazioni sensibili.

Posso impedire completamente alle aziende di IA di addestrarsi sul mio sito web?

Non con un unico interruttore tecnico. robots.txt può chiedere ai crawler conformi di stare alla larga, ma è volontario e non rimuove le copie che esistono già altrove.

robots.txt blocca legalmente l'addestramento dell'IA?

robots.txt è una convenzione tecnica, non un contratto di per sé. Può sostenere la tua posizione di policy, ma le questioni legali dipendono dalla giurisdizione, dai termini, dal diritto d'autore, dai contratti e dall'applicazione delle regole.