Il rilevamento arriva al 95 % su passaggi di 400 token e scende al 17 % dopo una riscrittura pesante. Per chi utilizza l’API, il marchio resta una scelta da attivare.
Il 5 ottobre 2026 OpenAI ha annunciato textGrain, il sistema con cui marchierà i testi e il codice generati da ChatGPT e Codex nell’Unione europea. Il segnale è un’impronta statistica che si deposita nella scelta delle parole e che un software di rilevamento riconosce in un secondo momento. L’attivazione è di default per gli utenti europei, con un dispiegamento previsto nelle prossime settimane. Per l’API il marchio resta spento di default in tutto il mondo e si accende dalle impostazioni di organizzazione o di progetto.
textGrain lavora sul lessico e lascia il testo composto di sole parole visibili. Calcola valori pseudocasuali a partire da una chiave segreta e dalle parole che precedono, e con quei valori orienta la scelta del vocabolario mantenendo la naturalezza della frase. Chi possiede la chiave può misurare, su un passaggio, quanto le scelte lessicali si discostano dal caso.
Le cifre pubblicate dipendono dalla lunghezza e dal trattamento del testo. Su passaggi di 400 token il rilevamento è intorno al 95 %, su 200 token intorno all’80 %. Con una sostituzione leggera del 10 % delle parole il risultato oscilla tra il 66 e il 92 %, con una riscrittura sostanziale del 25 % scende al 17 %. Nelle altre lingue europee il rilevamento si colloca tra il 42 e il 69 %. Secondo le ricostruzioni della stampa specializzata, anche testi brevi e contenuti matematici si fermano attorno all’80 %. OpenAI stessa ricorda che i risultati in condizioni ideali restano da verificare nell’uso quotidiano.
L’articolo 50, paragrafo 2, del Regolamento (UE) 2024/1689 impone ai fornitori di sistemi che generano contenuti sintetici di marcare gli output in un formato leggibile da macchina, con soluzioni efficaci, interoperabili, robuste e affidabili per quanto tecnicamente fattibile. Il Digital Omnibus ha concesso una finestra di quattro mesi, fino al 2 dicembre 2026, ai sistemi già presenti sul mercato prima del 2 agosto. I sistemi arrivati dopo dovevano marchiare fin dall’inizio.
Il 20 luglio 2026 la Commissione ha pubblicato le linee guida e un codice di buone pratiche sulla trasparenza. Il codice è volontario e indica la marcatura a più livelli, con metadati e filigrana insieme, perché ogni tecnica da sola ha un limite. Prevede inoltre meccanismi di rilevamento accessibili e, in genere, gratuiti, con una scadenza al 2 febbraio 2027 per l’interoperabilità delle filigrane. Le sanzioni raggiungono il maggiore fra 15 milioni di euro e il 3 % del fatturato mondiale annuo.
Il testo è il formato più difficile da marchiare, perché una frase si riscrive in pochi secondi. La curva di textGrain mostra il confine pratico: il marchio sopravvive alle correzioni leggere e si perde quando una persona rielabora a fondo. Per questo il quadro europeo punta su più livelli e sull’interoperabilità, e per questo il rilevatore pesa quanto il marchio. Oggi l’accesso al rilevatore è riservato a ricercatori e organizzazioni approvate, mentre la normativa europea prevede accesso per autorità, forze dell’ordine, media, fact-checker e società civile.
La scelta sull’API sposta una parte del lavoro sui clienti. Un’impresa italiana che integra un modello in un prodotto, in un assistente interno o in un flusso editoriale decide in prima persona se attivare il marchio e risponde dell’etichettatura dei testi pubblicati su temi di interesse pubblico quando agisce da deployer.
Tre date ordinano il calendario. Il 2 dicembre 2026 chiude la finestra per i sistemi già sul mercato, quindi i dispiegamenti dei grandi fornitori devono concludersi prima. Il 2 febbraio 2027 scade l’interoperabilità delle filigrane, il punto in cui si capisce se un testo marchiato da un fornitore sarà leggibile da un rilevatore di un altro. Nel frattempo vale la pena mappare i flussi dove un testo generato esce dall’organizzazione e verificare con ciascun fornitore quale livello di marcatura è attivo.
La domanda aperta riguarda la gara tra fornitori: la marcatura diventerà un requisito tecnico comune, con rilevatori compatibili, oppure ogni fornitore manterrà un proprio standard chiuso?
Autore
Pablo Liuzzi
Founder, Synthos Logic