corriere.it, 7 ottobre 2026
OpenAI introduce textGrain, filigrana invisibile per scovare i testi del chatbot
Anche OpenAI – come Anthropic – si adeguerà alle norme di trasparenza dell’AI Act entrate in vigore lo scorso 2 agosto. L’azienda di Intelligenza artificiale ha annunciato textGrain: una funzione che renderà riconoscibile un testo scritto con l’intelligenza artificiale attraverso un watermark, ovvero una filigrana invisibile.
Ecco textGrain, la filigrana per i testi
L’aggiornamento verrà implementato nelle prossime settimane e sarà aggiunto sia nelle generazioni di ChatGpt, sia in quelle di Codex. La novità agirà nel perimetro dell’Unione Europea, mentre fuori dall’Ue textGrain è già attivabile tramite Api, ma opzionalmente. Nessun simbolo o carattere nascosto sarà inserito all’interno del testo, tuttavia ci saranno delle precise scelte lessicali previste dal modello. La filigrana sarà perciò facilmente rilevabile sui testi lunghi, perché prodotta da uno schema statistico che uno strumento apposito riconoscerà con maggiore facilità. Ma esistono dei limiti.
La stessa OpenAI precisa che non è una vera e propria macchina della verità. La compagnia cita test interni con un tasso di falsi positivi pari all’1%, mentre il sistema è riuscito ad individuare la filigrana nell’80% dei testi di 200 token e nel 95% nei testi da 400 token di alcune categorie, come quelle di matrice psicologica. Diversamente, più un testo è breve, meno sembra preciso a identificare se l’abbia scritto l’AI o meno. Ma non solo: la difficoltà più grande si percepisce nei contenuti matematici. Un altro limite è la possibilità che i testi vengano modificati. Basterebbe infatti sostituire il 10% delle parole con dei sinonimi per far crollare la capacità di rilevamento dal 92% al 66%. E ancora: quando è al 25% la percentuale delle parole sostituite, il dato precipita al 17%.
Come funziona
Ma come funziona? Il nuovo textGrain può suggerire che sia stato un sistema di OpenAI a redigere un determinato testo o parte di esso, senza ricondurre all’identità dell’utente che ha dato vita alla generazione. Tantomeno potrà rivelare il prompt o la conversazione dalla quale lo stesso testo proviene. Allo stesso modo, lo scritto individuato come generato non è sufficiente a stabilire quanta parte del lavoro sia stata compiuta da una persona o da una intelligenza artificiale. Ma esistono anche limiti nell’utilizzo dello stesso rilevatore. L’accesso a textGrain sarà infatti concesso inizialmente a ricercatori e organizzazioni approvate a discrezione della compagnia, per la possibilità di incorrere a rischi di falsi positivi e falsi negativi.
Saranno comunque forniti da OpenAI ulteriori dettagli prossimamente. Lo scopo è quello di rendere la tecnologia textGrain open source. Ma la situazione è diversa per immagini e audio. OpenAI dispone già di uno strumento pubblico attraverso il quale è possibile caricare alcuni file e cercare i segnali di provenienza associati ai suoi sistemi. Per le immagini combina i Content Credentials basati sullo standard C2PA con il watermark invisibile SynthID di Google DeepMind; SynthID viene utilizzato anche per alcuni contenuti audio.