Curriculum o CV
Rimuovi telefono, indirizzo, data di nascita, firma e referenze. Chiedi struttura, tono e formulazione usando dei segnaposto.
Per i privati
La maggior parte degli errori sulla privacy con l'IA avviene in silenzio: un passaporto scansionato in un prompt, la foto di un bambino su una pagina pubblica, un CV incollato in un chatbot o note private caricate per essere riassunte. Questa pagina ti aiuta a decidere cosa va bene, cosa va oscurato e cosa dovrebbe restare offline.
Mappa dei rischi personali
La privacy con l'IA spesso fallisce in momenti ordinari: chiedere a un chatbot di riscrivere una lettera di reclamo con il tuo indirizzo completo, caricare un PDF medico per riassumerlo, incollare l'e-mail di un cliente o trasformare la foto di un bambino in un'immagine generata dall'IA. La domanda non è solo "questo addestrerà un modello?". È "questi dati dovrebbero davvero uscire dalle mie mani?".
Le regole per i crawler aiutano le pagine pubbliche. Non proteggono un file privato che incolli volontariamente in uno strumento. Per i privati, il controllo più forte è scegliere cosa resta in locale.
Esempi pratici
Rimuovi telefono, indirizzo, data di nascita, firma e referenze. Chiedi struttura, tono e formulazione usando dei segnaposto.
Non caricare l'intero file con leggerezza. Se ti serve un aiuto in linguaggio semplice, rimuovi prima nomi, date, numeri della clinica e dettagli identificativi.
Non caricare volti, bambini, interni di casa o foto ricche di indicazioni sul luogo, a meno che tu non ti senta a tuo agio con il fornitore e l'uso del prodotto.
Sostituisci nomi dei clienti, nomi dei progetti, prezzi e dettagli di conflitti interni. Mantieni la domanda generica dove possibile.
Cosa conta come dato personale
Quando le persone immaginano l'addestramento dell'IA, di solito pensano a un'azienda che copia deliberatamente un documento. In pratica, le informazioni personali tendono ad arrivare attraverso molti piccoli canali ordinari tutti insieme. Comprendere questi canali ti aiuta a decidere dove vale davvero la pena concentrare la tua attenzione. Nulla di tutto ciò è una consulenza legale, e il comportamento esatto di ogni fornitore cambia nel tempo, quindi tratta le descrizioni seguenti come una mappa generale più che come una garanzia.
Il testo che digiti in un chatbot, comprese le domande di follow-up, è un dato. A seconda del prodotto, del tipo di account e delle impostazioni, una parte di esso può essere conservata, esaminata da persone per la qualità o usata per migliorare i modelli. Le impostazioni predefinite per i consumatori e i termini per le aziende o le API spesso differiscono. Verifica le impostazioni attuali dello strumento specifico che utilizzi.
I file che alleghi, come PDF, fogli di calcolo, screenshot e immagini, vengono elaborati dal fornitore. Un singolo caricamento può contenere molto più di quanto intendi, inclusi metadati, colonne nascoste, commenti e tag di localizzazione incorporati nelle foto.
Tutto ciò che è visibile sul web aperto, inclusi i profili social impostati come pubblici, i commenti nei forum, le recensioni e i siti web personali, può essere recuperato dai crawler. Una volta che un contenuto è pubblico e copiato, una successiva cancellazione non rimuove in modo affidabile ogni copia memorizzata nella cache altrove.
Foto pubbliche, biografie, didascalie e connessioni sulle piattaforme social possono essere raccolte su larga scala. Le impostazioni e i termini delle piattaforme variano, e l'applicazione delle regole contro lo scraping indesiderato è incoerente, quindi un'impostazione "pubblica" è meglio considerarla come "potenzialmente raccolta".
I broker assemblano profili a partire da registri pubblici, acquisti, permessi delle app e altre fonti, poi li rivendono. Questi dati possono alimentare sistemi a valle. Spesso non hai scelto tu di essere elencato, ed è per questo che le richieste di opt-out contano, anche se sono parziali e lente.
Anche altre persone possono esporre i tuoi dati: un amico tagga una foto, un collega incolla un thread di e-mail che include il tuo indirizzo, o un familiare carica un documento condiviso. Non puoi controllare del tutto ciò che fanno gli altri, ma puoi ridurre ciò che contribuisci tu.
La tua esposizione è all'incirca la somma di ciò che carichi, di ciò che pubblichi e di ciò che altri pubblicano su di te. Hai il massimo controllo sulla prima, un controllo significativo sulla seconda e solo un'influenza parziale sulla terza. Investi il tuo impegno in quest'ordine.
Riduci la tua esposizione
Non devi fare tutto in una volta. Considera l'elenco seguente come un menu, non come un obbligo. Ogni voce abbassa un po' l'esposizione; nessuna di esse ti rende invisibile, e questo è un limite onesto piuttosto che un fallimento dell'approccio.
Le impostazioni predefinite per i consumatori differiscono
I fornitori assumono posizioni diverse sul fatto che gli input dei consumatori vengano usati per migliorare i modelli, e queste posizioni cambiano con gli aggiornamenti delle policy, i livelli di prodotto e le regioni. La tabella seguente descrive i tipi di differenze che potresti incontrare. È volutamente generica e non è un'affermazione attuale su alcun fornitore specifico. Conferma sempre confrontando con la documentazione ufficiale e le impostazioni nel prodotto prima di fare affidamento su una qualsiasi di esse, perché questo è esattamente il tipo di dettaglio che cambia senza troppo preavviso.
| Fattore | Cosa può significare | Come verificare |
|---|---|---|
| Tipo di account | I piani gratuiti, personali a pagamento, di team ed enterprise possono essere regolati da termini sui dati diversi. | Leggi i termini legati al tuo piano esatto, non una pagina di marketing generica. |
| Impostazione predefinita di addestramento | Alcuni prodotti usano gli input dei consumatori per migliorare i modelli in modo predefinito; altri no, o richiedono l'opt-in. | Cerca un'impostazione sui controlli dei dati o sulla privacy all'interno dell'app. |
| Disponibilità dell'opt-out | Un opt-out può esistere, essere limitato a determinate regioni o non applicarsi retroattivamente. | Conferma se l'impostazione riguarda i dati passati o solo gli input futuri. |
| API vs app | I termini per API e sviluppatori spesso trattano i dati in modo diverso rispetto all'app di chat per i consumatori. | Controlla la policy sull'uso dei dati delle API separatamente da quella dell'app. |
| Revisione umana | Gli input possono essere esaminati da persone per motivi di sicurezza o qualità, distinti dall'addestramento del modello. | Leggi come il fornitore descrive revisione, conservazione e accesso del personale. |
L'assunzione più sicura è che qualsiasi cosa tu non vorresti veder conservata non dovrebbe essere digitata o caricata in primo luogo. Le impostazioni aiutano, ma sono affidabili solo quanto la tua comprensione di esse nel giorno in cui usi lo strumento.
Oscura prima di incollare
L'oscuramento non riguarda la paranoia; riguarda il dare allo strumento solo ciò che il compito richiede. Un prompt ben anonimizzato di solito produce una risposta altrettanto buona, perché il modello raramente ha bisogno del tuo vero indirizzo per correggere una frase. Di seguito trovi un semplice schema prima-e-dopo che puoi adattare.
Prima:
"Riscrivi questo: Gentile Dott. Meier, riguardo a mio figlio Leon Muller,
ID paziente 44-8821 presso la Clinica di Zurigo, appuntamento il 12 marzo..."
Dopo:
"Riscrivi questo in un tono cortese e formale: Gentile [MEDICO], riguardo
a mio figlio/a [NOME], ID paziente [ID] presso la [CLINICA], appuntamento il [DATA]..."Sostituisci i nomi reali con [NOME] o un ruolo come [FIGLIO] o [RESPONSABILE]. L'aiuto sulla formulazione che desideri non dipende quasi mai dal nome reale.
Scambia numeri di conto, ID paziente, numeri di telefono e date di nascita con dei segnaposto. Se il numero esatto è importante per un calcolo, valuta di svolgere quella parte offline.
Ritaglia firme, intestazioni e numeri di riferimento. Per le foto, rimuovi i metadati di localizzazione ed evita sfondi che rivelino dove abiti o lavori.
Nulla di tutto ciò garantisce l'anonimato, poiché il contesto a volte può re-identificare una persona anche senza un nome. Rimuove però gli identificatori più evidenti e più dannosi, il che è un obiettivo ragionevole e raggiungibile per l'uso quotidiano.
Vecchi contenuti e opt-out
Ridurre l'esposizione futura è più facile che ripulire il passato, ma il passato conta comunque. Questa sezione tratta modi realistici, seppur imperfetti, per ridurre ciò che è già in circolazione. Aspettati risultati parziali, ritardi e l'occasionale ricomparsa di contenuti rimossi, perché questa è la natura onesta di questo lavoro.
Anche uno sforzo di rimozione perfetto non può richiamare le copie che erano già state memorizzate nella cache, archiviate o estratte prima che agissi. Gli opt-out e robots.txt sono convenzioni volontarie che molti, ma non tutti, gli attori rispettano. Trattali come riduzione del danno, non come cancellazione.
Miti e realtà
I consigli dal suono sicuro circolano rapidamente online, e alcuni di essi sono fuorvianti. Le coppie seguenti separano alcuni miti comuni da una lettura più attenta. Come sempre, si tratta di una guida educativa e non di una consulenza legale.
Realtà: l'eliminazione può rimuovere l'originale, ma le copie possono persistere in cache, archivi e set di dati raccolti in precedenza. Eliminare prima è comunque meglio che dopo, poiché limita per quanto tempo il contenuto è stato disponibile per essere copiato.
Realtà: non esiste un interruttore universale. Le impostazioni delle app, i controlli dei crawler del sito web e gli opt-out presso i broker sono livelli separati, ciascuno parziale. Ridurre l'esposizione significa combinarne diversi.
Realtà: contrassegnare un account come privato aiuta, ma screenshot, ricondivisioni e precedenti periodi pubblici possono lasciare tracce. Tratta "privato" come una riduzione, non un'eliminazione, dell'esposizione.
Realtà: robots.txt è una convenzione tecnica volontaria. Può esprimere la tua preferenza e sostenere una posizione di policy, ma di per sé non è un contratto, e la conformità non è universale. Le questioni legali dipendono dalla giurisdizione e dai fatti specifici.
Realtà: anche altri possono pubblicare i tuoi dati. Gestire i propri caricamenti è necessario ma non sufficiente, ed è per questo che anche la rimozione alla fonte e gli opt-out presso i broker fanno parte del piano.
Realtà: alcuni livelli a pagamento o aziendali offrono termini sui dati più rigorosi, ma non è automatico. Conferma i termini per il tuo piano specifico, invece di dare per scontato che pagare cambi l'impostazione predefinita.
Letture correlate
Confronta i modelli di IA prima di scegliere un flusso di lavoro.
ChatGPT Alternatives chatgpt-alternatives.comTrova alternative neutrali quando un solo fornitore di IA non basta.
AI Subscription Guide aisubscriptionguide.comScopri quale abbonamento IA si adatta al tuo lavoro reale.
Documentazione crawler OpenAI platform.openai.com/docs/gptbotControlla le indicazioni attuali di OpenAI su crawler e user-agent.
Documentazione crawler Google developers.google.com/search/docs/crawling-indexing/overview-google-crawlersVerifica i nomi dei crawler di Google, il comportamento di indicizzazione e i controlli relativi all'IA.
Supporto Anthropic support.anthropic.com/Controlla le indicazioni attuali su account Claude, dati e crawler.
FAQ
Puoi ridurre l'esposizione, ma non puoi garantire il pieno controllo una volta che le foto sono pubbliche. Mantieni private le foto sensibili, controlla le impostazioni della piattaforma, evita caricamenti pubblici ad alta risoluzione e usa i controlli per i crawler sul tuo sito web.
Solo dopo aver rimosso i dettagli che non ti servono per il compito. Nomi, indirizzi, numeri di telefono, date di nascita, firme, segreti del datore di lavoro e referenze possono spesso essere sostituiti con dei segnaposto.
Fai attenzione. Lettere mediche, passaporti, documenti scolastici, atti legali, file bancari e documenti di famiglia possono contenere dati sensibili su altre persone. Usa impostazioni sulla privacy approvate oppure non caricarli.
Dipende dal prodotto, dal tipo di account e dalle impostazioni. Alcuni fornitori offrono controlli, piani di team o termini API che trattano i dati in modo diverso. Controlla le impostazioni attuali prima di digitare informazioni sensibili.
Non con un unico interruttore tecnico. robots.txt può chiedere ai crawler conformi di stare alla larga, ma è volontario e non rimuove le copie che esistono già altrove.
robots.txt è una convenzione tecnica, non un contratto di per sé. Può sostenere la tua posizione di policy, ma le questioni legali dipendono dalla giurisdizione, dai termini, dal diritto d'autore, dai contratti e dall'applicazione delle regole.