Anonimizzazione

Anonimizzare i dati prima di ChatGPT: metodi, limiti e buone pratiche

Sostituire un nome con un segnaposto basta ad «anonimizzare»? Non ai sensi del GDPR. Questa guida distingue anonimizzazione e pseudonimizzazione, elenca i dati da mascherare e confronta con onestà i metodi, dalla rilettura manuale allo strumento installato sul computer.

Pubblicato il Aggiornato il 9 min di letturaA cura della redazione di Tacite-IA

Indice
  1. Perché anonimizzare prima di inviare un testo a un’IA
  2. Anonimizzazione o pseudonimizzazione: cosa dice il GDPR
  3. Cosa mascherare prima di ChatGPT
  4. Quattro metodi e i loro limiti
  5. Come funziona Tacite-IA, sul computer
  6. Le buone pratiche da ricordare
  7. Domande frequenti
  8. Fonti

«Ho tolto il nome, quindi è anonimo.» La frase rassicura, ma raramente è esatta. Prima di inviare una lettera a un cliente, un prospetto paghe o un verbale a ChatGPT o a un altro assistente, molti dipendenti tolgono ciò che sembra loro sensibile. È una buona abitudine. Bisogna però sapere che cosa il diritto intende per «anonimo», quali dati mascherare e che cosa protegge davvero ciascun metodo. Questa guida fa il punto, fonti alla mano, senza promettere più di quanto gli strumenti possano mantenere.

Perché anonimizzare prima di inviare un testo a un’IA

Un assistente IA online elabora il testo inserito e i file allegati sui server del suo fornitore. A seconda del piano e delle impostazioni, questi contenuti vengono conservati per un certo tempo e, per i servizi consumer, possono servire a migliorare i modelli. Nella pagina dedicata ai propri servizi per privati, OpenAI chiede del resto di non inserire informazioni sensibili che non si vorrebbe veder esaminate o utilizzate.6 Descriviamo queste regole, piano per piano, nel nostro articolo su che fine fanno i dati personali inseriti in ChatGPT.

Per l’azienda la questione è innanzitutto giuridica. Il GDPR impone che i dati personali siano «adeguati, pertinenti e limitati a quanto necessario» rispetto alla finalità (principio di minimizzazione, articolo 5).1 Eppure la maggior parte dei compiti affidati a un’IA, come riformulare, tradurre, riassumere o strutturare, non ha bisogno di sapere chi sia la persona interessata. In Francia la CNIL, l’autorità per la protezione dei dati, raccomanda del resto di regolamentare l’uso dell’IA generativa e di definire i dati che non vi devono essere inseriti.7

Il messaggio parte così com’è: nome, IBAN e informazione sanitaria arrivano al fornitore, che li tratta e li conserva secondo le regole del piano utilizzato.

Lo stesso messaggio, inviato così com’è o dopo la sostituzione dei dati sul computer. Dati fittizi.

Anonimizzazione o pseudonimizzazione: cosa dice il GDPR

I due termini vengono spesso usati come sinonimi. Eppure non indicano la stessa cosa, e la differenza ha conseguenze giuridiche dirette.

La pseudonimizzazione: dati che restano personali

Il GDPR definisce la pseudonimizzazione come un trattamento in virtù del quale i dati non possono più essere attribuiti a una persona specifica senza l’utilizzo di informazioni aggiuntive, a condizione che tali informazioni siano conservate separatamente e protette da misure tecniche e organizzative (articolo 4, punto 5).1 Sostituire «Claire Dupont» con «[NOME_1]» conservando da qualche parte la tabella di corrispondenza rientra tipicamente in questa categoria.

Il considerando 26 è esplicito: i dati pseudonimizzati, che potrebbero essere attribuiti a una persona mediante l’utilizzo di informazioni aggiuntive, restano informazioni su una persona identificabile.1 Il GDPR continua quindi ad applicarsi. Il Comitato europeo per la protezione dei dati (EDPB) vi ha dedicato delle linee guida, adottate il 16 gennaio 2025 in una versione sottoposta a consultazione pubblica, che illustrano l’utilità della pseudonimizzazione come misura di protezione.3 La CNIL lo riassume senza ambiguità: i dati pseudonimizzati conservano il carattere di dati personali e l’operazione è reversibile, a differenza dell’anonimizzazione.2

L’anonimizzazione: una trasformazione irreversibile

Al contrario, lo stesso considerando 26 precisa che il regolamento non si applica alle informazioni anonime, cioè a quelle che non si riferiscono a una persona identificata o identificabile, o rese anonime in modo da impedire l’identificazione della persona.1 Per valutarlo occorre considerare l’insieme dei mezzi di cui si può ragionevolmente prevedere l’utilizzo per identificare la persona, tenendo conto in particolare dei costi, del tempo necessario e della tecnologia disponibile.1

Per la CNIL, l’anonimizzazione deve rendere impossibile, in pratica, qualsiasi identificazione della persona con qualsiasi mezzo, e in modo irreversibile.2 Le autorità europee per la protezione dei dati, nel loro parere del 10 aprile 2014 sulle tecniche di anonimizzazione, propongono tre criteri per valutarla: l’individuazione (si può ancora isolare una persona?), la correlabilità (si possono collegare dati che la riguardano?) e la deduzione (si può dedurre un’informazione su di lei?).4

Cosa mascherare prima di ChatGPT

L’elenco dipende dal mestiere, ma alcune categorie ricorrono ovunque.

  • L’identità e i recapiti: nomi e cognomi, indirizzi postali, indirizzi e-mail, numeri di telefono, identificativi dei conti cliente.
  • Gli identificativi nazionali, a cominciare dal numero di previdenza sociale francese (NIR): la CNIL ricorda che può essere utilizzato solo in casi ben precisi, per lo più legati alla protezione sociale.5 Lo stesso vale per i numeri di passaporto o di carta d’identità.
  • I dati bancari: IBAN, numeri di carta, riferimenti di addebito diretto.
  • Le categorie particolari di dati dell’articolo 9 del GDPR: salute, opinioni politiche, convinzioni religiose, appartenenza sindacale, orientamento sessuale, origine.1 Un congedo per malattia menzionato in un’e-mail delle risorse umane vi rientra.
  • I segreti tecnici: password, chiavi API, token di accesso, stringhe di connessione. Non sono dati personali, ma la loro fuga può aprire l’accesso a interi sistemi. Gli sviluppatori vi sono particolarmente esposti con gli assistenti di programmazione (si veda la nostra guida per proteggere i segreti in Claude Code e Cursor).
  • Il contesto. È la trappola più frequente. «La direttrice finanziaria della nostra filiale di Lione, in malattia da marzo» identifica una persona senza citarne il nome. Il ruolo, la città, una data e un evento spesso bastano.
messaggio-hr.txtVersione anonimizzata

Puoi scrivere una risposta cortese per la Sig.ra Sophie Lambert[NOME_1]?

Chiede il rimborso delle sue spese sull’IBAN FR76 3000 6000 0112 3456 7890 189[IBAN_1].

Il suo n. di previdenza sociale: 2 84 05 75 112 345 28[NIR_1], raggiungibile al 06 45 87 12 90[TELEFONO_1].

4 dati sostituiti sul computer
I dati identificativi vengono sostituiti da segnaposto coerenti; la richiesta resta comprensibile per l’assistente. Dati fittizi.

Quattro metodi e i loro limiti

Esistono diversi modi per preparare un testo prima di inviarlo. Nessuno è perfetto, e la scelta giusta dipende dal volume, dal tipo di dati e dal livello di rischio.

1. Il metodo manuale

Rileggere il testo e sostituire a mano ogni dato con una dicitura neutra. Non costa nulla, e un essere umano attento individua bene il contesto identificativo, cosa che uno strumento automatico fa male. I suoi limiti sono noti: richiede tempo, diventa irrealistico su un file di diverse centinaia di righe e si basa interamente sull’attenzione della persona proprio quando ha fretta.

2. Gli strumenti di anonimizzazione online

Alcuni siti propongono di incollare un testo per ottenerne una versione «anonimizzata». Il paradosso è evidente: per proteggere dei dati da un servizio online, li si affida prima a un altro servizio online, spesso senza contratto né informazioni sulla conservazione. Prima di usarne uno, bisogna verificare chi lo gestisce, dove vengono trattati i dati e che fine fanno, esattamente come per l’assistente IA stesso.

3. Uno strumento installato sul computer

Un’estensione del browser o un programma locale analizza il testo sul computer, prima che parta. Il vantaggio principale: interviene nel momento preciso del copia e incolla o dell’aggiunta di un file, senza dipendere dalla memoria di ciascuno. I limiti: individua bene i dati strutturati (IBAN, NIR, e-mail, numeri di carta, chiavi API), ma molto meno il contesto libero; e protegge solo gli strumenti che copre realmente.

4. Un’IA installata localmente

Far girare un modello linguistico sul proprio computer per individuare i dati sensibili, o per fare del tutto a meno di un servizio online, è diventato possibile. I dati non lasciano il computer. Ma il risultato di un modello non è deterministico: può dimenticare un dato da una volta all’altra, a seconda delle impostazioni, senza che si possa sempre spiegare perché. Serve inoltre una macchina abbastanza potente, e l’installazione di questi strumenti merita lo stesso controllo di qualsiasi software.

CriterioManualeStrumento onlineStrumento localeIA locale
I dati restano sul computerSìNoSìSì
Interviene al momento del copia e incollaNoNoSìNo
Tratta anche i file allegatiIn parteIn parteSìIn parte
Risultato spiegabile e riproducibileIn parteIn parteSìNo
Individua i dati indiretti (contesto)SìIn parteIn parteIn parte
Non dipende dall’attenzione di ciascunoNoNoSìNo
Confronto indicativo dei quattro metodi, elaborato dalla redazione. «In parte» indica un risultato che dipende dallo strumento o dalla persona.

In pratica questi metodi si combinano. L’ANSSI, l’agenzia nazionale francese per la cybersicurezza, raccomanda in generale un approccio prudente nell’adozione dell’IA generativa e un’attenzione particolare ai dati trasmessi.8 Uno strumento locale per i dati strutturati, una rilettura umana per il contesto e una regola scritta per decidere i casi dubbi formano un insieme coerente.

Come funziona Tacite-IA, sul computer

Tacite-IA appartiene alla terza famiglia. L’analisi avviene interamente sul computer, senza IA: regole precise e calcoli di controllo (la chiave di un IBAN, di un numero di previdenza sociale, di una carta di pagamento) individuano i dati, il che rende ogni avviso spiegabile. Nessun messaggio o file viene inviato ai nostri server per l’analisi.

  • Per i messaggi, in Chrome ed Edge, con ChatGPT, Claude, Copilot, Gemini e altri assistenti: prima dell’invio, una finestra mostra i dati individuati e propone di inviare la versione in cui sono sostituiti da segnaposto.
  • Per i file Word, Excel, PowerPoint, PDF o di testo trascinati nell’assistente: il contenuto viene letto sul computer e al posto dell’originale viene inviata una copia di testo anonimizzata. I PDF scansionati o con caratteri codificati non sono leggibili: il loro contenuto non può essere verificato, e Tacite-IA lo segnala.
  • Negli assistenti di programmazione come Claude Code o Cursor: i messaggi e i file letti dall’assistente vengono controllati e viene proposta una copia anonimizzata.
export-clienti.xlsxVersione anonimizzata

cliente ; e-mail ; IBAN ; esposizione

Sig. Marc Petit[NOME_1] ; m.petit@exemple.fr[EMAIL_1] ; FR76 1027 8060 4100 0204 5590 174[IBAN_1] ; 3.200 €

Sig.ra Inès Roche[NOME_2] ; i.roche@exemple.fr[EMAIL_2] ; FR76 3000 4000 3123 4567 8901 429[IBAN_2] ; 870 €

6 dati sostituiti sul computer
Un file allegato trattato come un messaggio: le colonne utili al calcolo restano, le identità partono sotto forma di segnaposto. I nomi vengono individuati grazie al titolo che li precede (Sig., Sig.ra). Dati fittizi.

I limiti, detti con franchezza: come ogni strumento basato su regole, Tacite-IA individua bene i dati strutturati e le diciture di riservatezza, ma non comprende un contesto identificativo formulato liberamente. I nomi vengono individuati automaticamente solo se preceduti da un titolo (Sig., Sig.ra, Dott.…): un nome da solo, per esempio in una colonna di un foglio di calcolo, non lo è. Il testo inviato con i segnaposto resta, ai sensi del GDPR, generalmente pseudonimizzato e non anonimo. E le applicazioni desktop, come ChatGPT per computer, non sono coperte: Tacite-IA le segnala nella console senza poterle controllare.

Le buone pratiche da ricordare

  1. Chiedersi se il dato serveUna riformulazione o una traduzione funzionano benissimo senza il vero nome.
  2. Sostituire, non solo cancellareSegnaposto coerenti ([NOME_1], [IBAN_1]) mantengono il testo comprensibile.
  3. Pensare ai fileUn export o un contratto allegato contiene spesso più del messaggio stesso.
  4. Rileggere il contestoRuolo, città, data ed evento possono bastare a identificare qualcuno.
  5. Tenere la corrispondenza sul computerLa tabella segnaposto e valore non parte mai insieme al testo.
  6. Mettere la regola per iscrittoUna policy che dica cosa mascherare e con quale strumento.
Sei abitudini semplici, da riprendere nella policy sull’uso dell’IA.

Queste abitudini trovano posto in una regola scritta: il nostro modello di policy IA prevede un articolo dedicato ai dati vietati e all’anonimizzazione. Per i settori soggetti a segreto professionale, i requisiti vanno oltre: si vedano le nostre guide dedicate ai commercialisti e ai dati sanitari.

Domande frequenti

Sostituire i nomi con dei segnaposto basta ad anonimizzare i dati?

In generale no. Se la corrispondenza tra segnaposto e valori reali esiste da qualche parte, o se il contesto consente di risalire alla persona, si tratta di una pseudonimizzazione: secondo il considerando 26 del GDPR, i dati restano personali. È comunque una buona misura di minimizzazione prima dell’invio a un’IA.

Qual è la differenza tra anonimizzazione e pseudonimizzazione?

La pseudonimizzazione impedisce di attribuire i dati a una persona senza informazioni aggiuntive conservate separatamente (articolo 4 del GDPR): i dati restano soggetti al regolamento. L’anonimizzazione rende impossibile in pratica qualsiasi reidentificazione, in modo irreversibile: il GDPR non si applica più.

Quali dati non bisogna mai inserire in ChatGPT?

In azienda occorre togliere almeno nomi e recapiti, gli identificativi come il numero di previdenza sociale, i dati bancari, i dati sanitari e gli altri dati sensibili dell’articolo 9 del GDPR, oltre a password e chiavi di accesso. Anche il contesto (ruolo, luogo, data) può bastare a identificare qualcuno.

Gli strumenti di anonimizzazione online sono sicuri?

Obbligano ad affidare i dati a un servizio terzo ancora prima dell’invio all’IA. Prima di usarne uno, bisogna verificare chi lo gestisce, dove vengono trattati i dati e per quanto tempo vengono conservati. Uno strumento che lavora sul computer evita questo passaggio.

Un’IA locale è una buona soluzione per anonimizzare?

Tiene i dati sul computer, il che è un vantaggio reale. Ma i suoi risultati non sono deterministici: un dato può essere dimenticato da una volta all’altra senza spiegazione. Richiede inoltre una macchina potente e un controllo dell’installazione.

Fonti

  1. Regolamento (UE) 2016/679 relativo alla protezione delle persone fisiche con riguardo al trattamento dei dati personali (GDPR). EUR-Lex. Consultata il 5 ottobre 2026.
  2. L’anonymisation de données personnelles. CNIL (autorità francese per la protezione dei dati), 19 maggio 2020. In francese. Consultata il 8 ottobre 2026.
  3. Guidelines 01/2025 on Pseudonymisation (versione sottoposta a consultazione pubblica). Comitato europeo per la protezione dei dati (EDPB), adottate il 16 gennaio 2025. In inglese. Consultata il 8 ottobre 2026.
  4. Parere 05/2014 sulle tecniche di anonimizzazione (WP216). Gruppo di lavoro «Articolo 29» per la protezione dei dati, 10 aprile 2014. Consultata il 8 ottobre 2026.
  5. Qui peut me demander mon numéro de sécurité sociale (NIR) ?. CNIL (autorità francese per la protezione dei dati). In francese. Consultata il 8 ottobre 2026.
  6. How OpenAI handles data in consumer services. OpenAI Help Center. Consultata il 5 ottobre 2026.
  7. Les questions-réponses de la CNIL sur l’utilisation d’un système d’IA générative. CNIL (autorità francese per la protezione dei dati), 18 luglio 2024. In francese. Consultata il 5 ottobre 2026.
  8. Recommandations de sécurité pour un système d’IA générative. ANSSI (agenzia nazionale francese per la cybersicurezza), 29 aprile 2024. In francese. Consultata il 5 ottobre 2026.
Una misura tra le altre

Regolamentare l’uso, senza frenare i team

Tacite-IA individua i dati sensibili nei messaggi e nei file prima del loro invio agli assistenti IA in Chrome ed Edge, oltre che negli assistenti di programmazione (Claude Code, Cursor, Windsurf, Codex, Gemini CLI, Copilot CLI). L’analisi avviene al 100% sul computer, senza IA, con una console di amministrazione e una modalità audit. Le applicazioni desktop (ChatGPT per computer, scheda Chat di Claude Desktop, Copilot di Windows) non sono coperte.

6 € IVA esclusa per utente al mese con il piano annuale, 8 € IVA esclusa con il piano mensile. Prova di 3 mesi.

Da leggere anche