Questo sito utilizza cookies tecnici (propri e di terze parti) come anche cookie di profilazione (di terze parti) sia per proprie necessità funzionali, sia per inviarti messaggi pubblicitari in linea con tue preferenze. Per saperne di più o per negare il consenso all'uso dei cookie di profilazione clicca qui. Scorrendo questa pagina, cliccando su un link o proseguendo la navigazione in altra maniera, acconsenti all'uso dei cookie Ok, accetto

 2026  ottobre 01 Giovedì calendario

Libri scritti con l’IA? Ma i test falliscono

L’elefante è nella stanza e il mondo dell’editoria trema. Dopo la clamorosa esclusione dal premio Goncourt di Thélyson Orélien, l’autore accusato da un account X di aver scritto il suo romanzo utilizzando l’IA, nessuno si sente al sicuro. E l’Italia non fa eccezione. E se accadesse a un autore in corsa a un premio letterario? Le case editrici stanno prendendo provvedimenti? Hanno una strategia? Il tema è all’ordine del giorno, confessano gli addetti ai lavori rigorosamente off the record: telefonate, riunioni, report allarmati. Intanto, bocche cucite, ma dopo il caso Goncourt negli uffici non si parla d’altro. Da Mondadori, con Einaudi, a Feltrinelli al gruppo Gems tutti prendono tempo prima di esporsi. Del resto è un campo minato. Nessun sistema di verifica, come dimostreremo, è sicuro. Allo stesso tempo chiunque può scaricare uno dei tanti sistemi di rilevazione disponibili in rete e, sulla base dei risultati, accusare un autore di aver pubblicato un libro che non è farina del suo sacco. In America, e adesso in Francia, gli editori stanno studiando un bollino – “questo libro è 100% umano” – da piazzare in copertina. Ma con quale certezza? Chi certifica chi?
Si chiamano “AI detector” e sul web se ne trovano tantissimi, gratuiti e a pagamento. Nelle università sono ormai usatissimi per inchiodare gli studenti che si affidano all’algoritmo per scrivere le tesi. E la macchina, il grande fratello artificiale, ingrassa con i dati che raccoglie. È l’IA che prima genera e poi controlla se stessa. Con esiti mai certi. Come dimostra una piccola prova alla quale abbiamo sottoposto diverse piattaforme di verifica.
Il test
Abbiamo scelto alcune pagine di sette romanzi italiani. Tre vincitori di premi e tre bestseller di genere che scalano le classifiche. L’ultimo è un classico della letteratura italiana, scritto quando l’IA non c’era ancora: La malora di Beppe Fenoglio, anno 1954. Abbiamo usato cinque diversi rilevatori: tre nella versione a pagamento – Pangram, ChatGpt e Perplexity – due in quelle gratuite, Originality e Textguard. I detector hanno concordato, certificandoli come cento per cento umani, solo su due romanzi vincitori di premi, Di spalle a questo mondo di Wanda Marasco, Campiello 2025, e I convitati di pietra di Michele Mari, Strega 2026. E su Fenoglio. Con una curiosità. ChatGpt ha identificato il capolavoro dello scrittore di Alba: «Qui – scrive il chatbot – mi hai teso una trappola: è La malora». Qualcuno glielo aveva già dato in pasto.
Sì, no, forse
E negli altri casi? I sistemi non sono d’accordo, neanche nelle loro versioni a pagamento, quindi in teoria più accurate. Prendiamo due casi tra quelli sottoposti al test. Uno è il romance dell’autrice più venduta in Italia, First lady per caso di Felicia Kingsley (Newton Compton). L’altro è Le perfezioni di Vincenzo Latronico (Einaudi), finalista al prestigiosissimo Booker Prize nel 2025. In entrambi i casi, Pangram, lo stesso software che ha inchiodato Orélien, li certifica cento per cento umani. Perplexity, invece, quotatissimo tra gli accademici, è ambiguo. Se su alcune pagine di Latronico dà una percentuale tra il 50 e il 65 per cento di utilizzo di IA, su altre praticamente la azzera: 3 per cento. Anche su Kingsley il giudizio è disomogeneo: in un caso attesta le pagine al 75 per cento umane. Nel secondo la percentuale crolla al 40 per cento. È chiaro che qualcosa, nel sistema di rilevazione, non funziona.
Il grande calderone
Abbiamo sottoposto al test anche due titoli che hanno dominato le classifiche. L’ultimo dark romance di Carrie Leighton, che con la sua saga Better (Salani) ha venduto 500 mila copie, e uno dei romanzi di Gianluca Gotto, lo scrittore Mondadori “mistico” ininterrottamente in classifica da 210 settimane. Pangram li promuove entrambi al cento per cento. Secondo Perplexity invece, nel caso di Leighton il romanzo è “IA assistito”, quindi scritto con l’aiuto dell’algoritmo, in una forbice che va tra il 65 e l’80 per cento. La piattaforma gratuita Originality dà addirittura il 73 per cento di probabilità che sia generato dalla macchina. Ma che significa? Che l’IA avrebbe generato la trama? Che il testo è stato sottoposto a editing dal chatbot? Risposte incerte anche su Gotto. Pangram lo salva, Perplexity e Originality lo bocciano: per il primo software Quando inizia la felicità è IA assistito al 60 per cento, per l’altro è generato dall’IA al 93 per cento.
L’algoritmo cade in fallo
Come ultima prova, abbiamo sottoposto ai detector un incipit generato appositamente con l’intelligenza artificiale: un sistema di rilevazione gratuito gli ha concesso il 50 per cento di possibilità di essere autenticamente umano. Perplexity lo ha dato artificiale solo al 70 per cento. Pangram lo ha bocciato: non è umano.
Ma sulla base di quali criteri?
La risposta di Perplexity, alla quale l’abbiamo chiesto, è spiazzante: «Non esiste un insieme di parametri che permetta di stabilire con certezza, dal solo testo, che un brano sia stato scritto da IA. Esistono strumenti probabilistici». Che, per le diverse piattaforme, sono più o meno gli stessi: prevedibilità delle parole che compaiono nelle pagine, uso di termini molto comuni, costruzioni delle frasi standardizzate e uniformità grammaticale. Pangram spiega che il suo algoritmo è stato addestrato attraverso il sistema “dello specchio”: «Per ogni esempio umano, generiamo un esempio prodotto dall’IA che corrisponda al documento originale su quanti più assi possibile». Un’altra criticità è che i chatbot sono addestrati soprattutto con i testi in lingua inglese. Mark Spero, amministratore delegato di Pangram, società di Brooklyn, a New York, dopo il caso Orélien, ha detto che il suo detector ha un margine di errore per i testi in francese dello 0,0026 per cento. Ma al New York Times che glielo ha chiesto ha ammesso che non esistono studi indipendenti che certificano questo dato. E all’Atlanticha sottolineato che «Pangram non dovrebbe mai essere l’arbitro finale, ma piuttosto un punto di partenza per un’indagine più approfondita». Un’indagine fatta da chi? E con quali strumenti?
L’altra faccia della medaglia
Se finora i titoli ritirati dal mercato negli Stati Uniti sono di narrativa di genere (per esempio l’horror di Mia Ballard Shy Girl e il thriller di Jerry Falade contesissimo alle aste) il caso Goncourt, con l’esclusione di un concorrente dalla gara, tira in ballo anche la narrativa letteraria.
Solo che in questo caso il libro è ancora in vendita e domina le classifiche francesi. C’était ça ou mourir, pubblicato da Grasset, ha venduto circa 50 mila copie. E in Italia sarà pubblicato da Rizzoli. Che al momento resta cauta: «Abbiamo comprato il romanzo dalla casa editrice Boréal e l’abbiamo apprezzato per la sua voce. In Francia l’ha pubblicato un grandissimo editore come Grasset, ed è attualmente al primo posto nella classifica dei libri più venduti – dice Massimo Turchetta, direttore generale e publisher di Rizzoli – Le maggiori case editrici in tutto il mondo hanno partecipato all’asta internazionale per acquisirne i diritti. Boréal sta approfondendo l’analisi del testo per chiarire oltre ogni dubbio cosa sia successo, e Rizzoli rimane in attesa di avere un quadro più completo». Non tutte le IA vengono per nuocere.