Vai al contenuto

I rilevatori di AI sono affidabili?

Aggiornato il · 7 min di lettura · a cura del team di HidenGPT

No, non abbastanza da provare chi ha scritto un testo: un rilevatore AI stima quanto un testo somiglia a ciò che ha imparato a considerare generato, e può sbagliare in tutte e due le direzioni. Lo scrivono anche i produttori: Turnitin chiede di non usare la percentuale come unica base per decidere, Compilatio che nessun rilevatore è affidabile al 100%.

Per chi scrive in italiano c'è un dettaglio in più: al 10 ottobre 2026 il rilevamento AI di Turnitin non elabora testi in italiano, mentre Compilatio dichiara di farlo. Se un rilevatore segnala un testo che hai scritto tu, la prova migliore è il percorso con cui l'hai scritto: cronologia delle versioni, appunti, bozze.

Cosa dicono studi e produttori sull'affidabilità dei rilevatori (fonti in fondo alla pagina, lette il 10 ottobre 2026)
FonteCosa è stato misurato o dichiaratoRisultato
Liang e altri, Stanford, 2023Sette rilevatori su 91 saggi TOEFL scritti da non madrelingua inglesi e su 88 saggi di studenti statunitensi dell'8th gradeFalsi positivi in media del 61,22% sui saggi TOEFL; 18 saggi (19,78%) segnalati da tutti e sette, 89 (97,80%) da almeno uno; quasi nessun errore sui saggi statunitensi
Classificatore di OpenAI, gennaio 2023Un insieme di prova di testi in ingleseRiconosceva come probabilmente AI il 26% dei testi generati e segnalava per errore il 9% dei testi umani; ritirato il 20 luglio 2023 per la bassa accuratezza
Turnitin, FAQ sul rilevamento AIDichiarazione del produttoreFalsi positivi sotto l'1% per documenti con oltre il 20% di scrittura AI; punteggi tra 1% e 19% mostrati solo con un asterisco; lingue: inglese, spagnolo, giapponese, arabo, olandese, tedesco, turco
Compilatio, assistenza in italianoDichiarazione del produttoreAffidabilità dal 94 al 99% e falsi positivi sotto l'1%, misurati su circa 7.400 testi in 24 lingue, italiano compreso; «nessun rilevatore AI può essere affidabile al 100%»

Che cosa misura davvero un rilevatore

Un rilevatore non ha visto nessuno scrivere. È un modello che guarda le parole e ne ricava una stima. Alcuni misurano quanto è prevedibile ogni parola rispetto a quelle che la precedono, perché i modelli linguistici tendono a scegliere le parole più probabili; altri sono classificatori addestrati su esempi etichettati come umani o generati, che giudicano un testo nuovo per somiglianza.

Il risultato è una percentuale, e ogni strumento le dà un significato suo. In Compilatio Magister+ indica la quota di testo con uno stile simile a quello dell'AI: su un documento di 1.000 parole, il 10% vuol dire che 100 parole hanno quello stile. In Turnitin è la parte del testo che il modello ritiene probabilmente generata o modificata da un'AI. In nessuno dei due casi è la probabilità che tu abbia copiato, e nessuno dei due mostra una prova da confrontare come succede con le somiglianze: Compilatio scrive che per i passaggi segnalati come AI non può dare un riscontro visivo.

Perché sbagliano, e con quali testi

Con i testi prevedibili. Una tesi compilativa, una struttura rigida, connettivi da manuale come «inoltre» e «in conclusione», frasi tutte simili: sono abitudini che lo studio insegna e che un rilevatore può scambiare per scrittura generata. Turnitin stesso scrive che tra i falsi positivi compaiono testi con poca varietà strutturale, ripetizioni e parafrasi che non aggiungono idee.

Con chi scrive in una seconda lingua. Nello studio di Stanford bastava cambiare le parole per spostare il risultato: arricchendo il lessico dei saggi TOEFL i falsi positivi scendevano dal 61,22% all'11,77%, mentre semplificando quello dei saggi statunitensi salivano dal 5,19% al 56,65%.

Con i testi brevi. OpenAI definiva il suo classificatore molto inaffidabile sotto i 1.000 caratteri, e Turnitin avverte che su documenti di poche centinaia di parole la previsione diventa quasi «tutto o niente».

E nel tempo: Compilatio spiega che lo stesso documento può dare risultati diversi da un'analisi all'altra, per il formato del file, per la natura probabilistica dei modelli e per gli aggiornamenti dell'algoritmo. Nell'altra direzione, i rilevatori lasciano passare testi generati: il classificatore di OpenAI ne riconosceva solo il 26%.

Tesi e testi in italiano: cosa cambia

Dipende dal software del tuo ateneo. Secondo la FAQ di Turnitin, letta il 10 ottobre 2026, il rilevamento AI funziona per testi lunghi in inglese, spagnolo, giapponese, arabo moderno, olandese, tedesco e turco; un documento in una lingua non supportata non viene elaborato e il report AI non viene generato. Il report di similarità è un controllo diverso.

Compilatio, un altro software antiplagio con un rilevatore AI, dichiara invece che il suo rilevatore, incluso nell'abbonamento Magister+, è multilingue e che le misure di affidabilità comprendono testi in italiano. Sono però numeri del produttore, ottenuti su testi generati con domande semplici e senza istruzioni di stile, e la stessa pagina avverte che i tassi comunicati dai diversi rilevatori non sono confrontabili tra loro. Anche OpenAI, quando aveva un classificatore, raccomandava di usarlo solo in inglese perché nelle altre lingue funzionava molto peggio.

Prima del rilevatore, però, viene la regola. Le linee guida dell'Università di Modena e Reggio Emilia del 29 luglio 2026, per esempio, vietano l'AI generativa nella stesura della tesi e dell'elaborato finale salvo autorizzazione esplicita e preventiva del docente o della commissione, e chiedono agli studenti di dichiarare se, quanto e per cosa l'hanno usata. Leggi quelle del tuo ateneo e del tuo corso.

Se un rilevatore segnala un testo che hai scritto tu

Non toccare niente. Conserva la versione segnalata così com'è e salva la cronologia del documento: in Google Documenti e in Word, se il file è su OneDrive, le versioni precedenti restano con data e ora.

Poi chiedi tre cose: quale software ha dato il punteggio, cosa significa quella percentuale in quello strumento e cosa prevede il regolamento quando un risultato viene contestato. Proponi di spiegare a voce come hai costruito il lavoro, quali fonti hai letto e perché hai fatto certe scelte. Se diventa un procedimento formale, i rappresentanti degli studenti e, dove c'è, il Garante degli studenti possono aiutarti con le procedure.

Riscrivere un testo tuo solo per abbassare un punteggio non prova nulla e allontana la versione che puoi difendere. Una nota sugli strumenti: HidenGPT non promette nulla su alcun rilevatore, e il punteggio di naturalezza della sua penna rossa misura la leggibilità di un testo, non da dove viene.

Errori comuni

  • Prendere il punteggio come una prova: è la stima di uno strumento in un certo giorno; contano la cronologia, gli appunti e la capacità di spiegare il lavoro.
  • Leggere «30% AI» come «un terzo l'ha scritto un'AI»: controlla cosa misura quel software; in Compilatio è la quota di testo con uno stile simile all'AI.
  • Provare un rilevatore gratuito dopo l'altro finché uno ti dà ragione: gli strumenti non concordano tra loro e nessuno decide al posto del docente.
  • Riscrivere la tesi segnalata prima di parlarne: mostra prima l'originale e la sua cronologia.
  • Confondere la percentuale di similarità con quella AI: sono due misure diverse, anche quando compaiono nello stesso report.
  • Considerare un punteggio basso come la prova di aver scritto tu: i rilevatori mancano anche testi generati, e il classificatore di OpenAI ne riconosceva solo il 26%.

Domande

I rilevatori AI sono affidabili per la tesi?

Non come prova. Possono segnalare testi scritti da te e lasciar passare testi generati; in più, al 10 ottobre 2026, il rilevamento AI di Turnitin non elabora l'italiano, quindi molto dipende da quale software usa il tuo ateneo.

Turnitin rileva l'AI nei testi in italiano?

No, al 10 ottobre 2026. Le lingue supportate sono inglese, spagnolo, giapponese, arabo, olandese, tedesco e turco, e un testo in un'altra lingua non riceve il report AI; il report di similarità è un controllo a parte.

Compilatio è affidabile?

Compilatio dichiara un'affidabilità dal 94 al 99% e meno dell'1% di falsi positivi, su circa 7.400 testi in 24 lingue. Sono numeri del produttore, non di uno studio indipendente, e la stessa pagina avverte che nessun rilevatore è affidabile al 100%.

Perché il rilevatore dice che il mio testo è scritto dall'AI se l'ho scritto io?

Di solito perché alcune parti sono prevedibili: struttura rigida, connettivi da manuale, frasi simili tra loro. Anche scrivere in una seconda lingua pesa: nello studio di Stanford i saggi di non madrelingua inglesi venivano segnalati in media nel 61% dei casi.

Esiste un rilevatore AI gratuito affidabile?

Gratuito o a pagamento, il limite è lo stesso: i rilevatori stimano dalle parole e possono sbagliare in tutti e due i sensi. Un risultato gratuito non vale come prova più di uno a pagamento.

Un docente può decidere solo in base al punteggio?

Non dovrebbe: Turnitin scrive che la percentuale non va usata come unica base per decidere, e Compilatio che spetta al valutatore interpretarla. Cosa succede davvero lo stabilisce il regolamento del tuo ateneo.

Se ricarico lo stesso file, il risultato cambia?

Può cambiare. Compilatio spiega che lo stesso documento può dare risultati diversi per il formato del file, la natura probabilistica dei modelli e gli aggiornamenti dell'algoritmo.

Come dimostro di aver scritto io il testo?

Con il percorso: cronologia delle versioni, appunti, bozze mandate al relatore, fonti lette. E con la disponibilità a spiegare a voce le scelte del lavoro.

Fonti

  1. Liang, Yuksekgonul, Mao, Wu e Zou (2023), «GPT detectors are biased against non-native English writers», arXiv (consultato il 10 ottobre 2026)
  2. OpenAI, «New AI classifier for indicating AI-written text» (31 gennaio 2023, nota del 20 luglio 2023), copia dell'Internet Archive del 7 ottobre 2026 (consultato il 10 ottobre 2026)
  3. Turnitin Guides: Turnitin's AI writing detection capabilities FAQs (consultato il 10 ottobre 2026)
  4. Compilatio, assistenza: Il rilevatore AI di Compilatio è affidabile? (consultato il 10 ottobre 2026)
  5. Compilatio, assistenza: Come va interpretata la percentuale di testi potenzialmente generati dall'IA in Compilatio Magister+? (consultato il 10 ottobre 2026)
  6. Compilatio, assistenza: Compilatio Magister+ dimostra l'uso dell'IA generativa? (consultato il 10 ottobre 2026)
  7. Compilatio, assistenza: Perché i risultati IA variano tra le analisi? (consultato il 10 ottobre 2026)
  8. Università di Modena e Reggio Emilia, Linee guida per l'utilizzo di strumenti di intelligenza artificiale (29 luglio 2026, PDF) (consultato il 10 ottobre 2026)