Rilevatore IA: un segnale, non un verdetto
Il rilevamento AI arriverà presto — è sulla nostra roadmap, non ancora attivo. Al lancio, ogni rilevatore AI — incluso il nostro — sbaglierà a volte. Noplag restituirà un punteggio di probabilità calibrato, non un sì/no, e pubblicherà il tasso di falsi positivi su testi di scrittori non madrelingua inglese. Copertura prevista: ChatGPT, Claude, Gemini, GPT-5 e Llama. Legga in anticipo cosa significherà davvero il punteggio prima di agire — soprattutto se decide su uno studente o un candidato. Il rilevamento è solo uno dei segnali; non dovrebbe mai essere l'unico.
Signal di rilevamento per ogni LLM principale.
Ogni modello lascia una firma statistica diversa. Le tracciamo per versione e pubblichiamo la calibrazione per modello così che sappia cosa significa il punteggio per il LLM che ha generato il testo analizzato.
ChatGPT
Famiglie gpt-4o, o1, o3. Tracciamo il drift dell’output tra versioni; calibrazione per modello aggiornata entro 30 giorni da ogni rilascio. Il report indica la famiglia del modello a cui il segnale corrisponde meglio.
Claude
Sonnet, Opus, Haiku sulle versioni 3.x e 4.x. Il segnale di rilevamento varia per modalità (riflessione vs. veloce); ogni report indica la calibrazione per modalità.
Gemini
1.5 Pro, 2.0 Flash, 2.5 Pro. Il segnale multilingue è più debole nei testi non in inglese; il report lo segnala come “confidence bassa su risorse” invece di nasconderlo.
GPT-5
Release OpenAI di agosto 2025. Firma comportamentale diversa da gpt-4o; aggiorniamo la calibrazione sui riferimenti del modello entro 30 giorni dal rilascio.
Llama
Famiglia 3, 3.1, 3.3. Variante self-host più complicata — il fine-tuning modifica la firma. Il report indica 'probabile generazione LLM, famiglia Llama' senza forzare la versione.
Ogni rilevatore AI sovra-segnala i testi di scrittori non madrelingua inglese. Ecco cosa facciamo.
Liang et al. (Stanford, 2023): 61% di falsi positivi su saggi TOEFL — sei volte rispetto ai madrelingua. Ogni rilevatore, anche il nostro prima della correzione.
La ricerca Stanford
Liang et al. (2023) ha testato ogni rilevatore AI commerciale su saggi TOEFL di scrittori non inglesi madrelingua. Il rilevatore di riferimento ha marcato il 61% come testo AI — sei volte il tasso sui madrelingua. Stessi testi, stessa consegna.
Cosa abbiamo ricorretto
Abbiamo riaddestrato il classificatore rimuovendo le caratteristiche tipiche dello stile ESL — lunghezza uniforme delle frasi, vocabolario semplice, pochi idiomi non sono pesati come segnali AI. Solo feature cieche allo stile. Prediciamo dalla struttura, non dalla cura stilistica.
Errore residuo
Dopo la correzione: un intervallo di confidenza documentato per ogni lingua, invece di un unico valore sintetico. Le tabelle per lingua vengono pubblicate quando la funzionalità supera la valutazione — esattamente ciò che richiederebbe una verifica istituzionale.
Quando ignorare il risultato
Se valuta uno scrittore ESL e il punteggio cade tra 20–80%, lo consideri solo come consiglio. Indichiamo esplicitamente 'confidenza bassa — interpretare con cautela' nel report, per chiarire quando non agire.
Cosa ancora manca
Scrittura ibrida — bozza LLM rifinita da madrelingua — è più difficile di entrambi i casi puri. Il report segnala 'signal misto, probabile ibrido' invece di indovinare; l’errore residuo si concentra qui.
Dove misuriamo
Set pubblici di saggi TOEFL, elaborati accademici panispanici e scritti multilingue valutati secondo il CEFR. Gli stessi dati utilizzati da Liang et al., più 8 nuovi corpora raccolti tra il 2024 e il 2026. I riferimenti vengono pubblicati insieme alla metodologia al rilascio della funzionalità.
Una probabilità, non un verdetto.
Il punteggio è una probabilità da 0% a 100%. Sopra l’80%: alta probabilità di AI. Sotto il 20%: alta probabilità di umano. La fascia 20–80% va trattata come un solo segnale, non una prova. Usi il rilevamento per iniziare la discussione, non per chiuderla.
Elevata probabilità che il testo sia stato scritto da una persona. Il tasso di falsi positivi per questa fascia viene pubblicato per ogni lingua quando la funzionalità supera la valutazione.
Il modello non è certo. Usi il punteggio come uno tra i tanti dati — campioni precedenti, bozze, produzione in classe. Non agisca su questa fascia da sola.
Alta probabilità che il testo sia prodotto da un modello linguistico. Non è comunque un verdetto. Combini con contesto (prompt, cronologia browser, colloquio orale) prima di ogni decisione.
- 5Famiglie di LLM coperte al lancio
- 61%Falsi positivi ESL, Stanford '23
- 30dcadenza di riaddestramento prevista dopo ogni rilascio del modello
- v1.2obiettivo di rilascio per il rilevamento AI
- 2024inizio R&D rilevamento
Stiamo dalla parte dell’integrità. Non lanciamo tool per eludere il rilevamento.
Un umanizzatore serve a eludere il rilevamento AI — riscrive testo LLM per abbassarne il punteggio. Potremmo costruirlo. Non lo facciamo. L’obiettivo qui è mostrare l’uso di AI, non aiutare a nasconderlo. Se il rilevamento deve essere utile, chi costruisce rilevatori e chi distribuisce umanizzatori non possono coincidere. Scegliamo solo uno dei due. Quando citiamo umanizzatori è per segnalarne l’esistenza — possono essere a monte del testo che controlla — non per vendergliene uno.
Legga la posizione completaCome ci confrontiamo con GPTZero, Originality.ai, Winston.
Focalizzato su education, niente plagio, calibrazione opaca. Solo rilevamento AI; se serve anche il plagio, sono due strumenti.
Rilevamento e plagio con motore open source. Dati di calibrazione per ogni modello pubblicati. Stesso report, stesso fornitore, verificabile end-to-end.
Marketing '97% di accuratezza'. Falsi positivi non dichiarati. Calibrazione solo su inglese. Closed source — non può controllare il punteggio.
Trasparenza sul bias verso chi scrive in inglese come seconda lingua (citiamo Liang 2023 esplicitamente). Calibrazione multilingue. Motore open source; la metodologia viene pubblicata insieme alla funzione.
Forte su ChatGPT. Più debole su Claude e Gemini. Prezzi alti per volumi; tariffe a scaglioni dopo 10k parole/mese.
Copertura di tutte le famiglie modello principali con uguale cura per calibrazione. Prezzo flat-rate fino al tier Pro. Opzione self-host per utenti con normative.
Dodici domande, risposte trasparenti.
Se non sappiamo la risposta, lo diciamo. Aggiorniamo quando cambia la calibrazione.
- Il rilevamento AI è affidabile?
- Risposta onesta: nessun rilevatore è affidabile su testi inferiori a circa 200 parole, e tutti presentano tassi di falsi positivi che variano in base allo stile di scrittura, alla lingua e al LLM utilizzato. Noplag si impegna a pubblicare i propri dati di calibrazione, così puoi sapere cosa significa 'accurato' per il tuo caso specifico; i dati vengono pubblicati insieme alla funzionalità.
- Noplag segnalerà come AI il mio inglese non madrelingua?
- È possibile — lo diciamo chiaramente. Liang et al. (Stanford 2023) mostra che ogni rilevatore AI commerciale sovra-segnala scrittori ESL. Le nostre tutele limitano il tasso di falsi positivi per profili ESL noti e pubblichiamo l’errore residuo. Se il segnale è poco chiaro, il report lo indica.
- Che modelli AI rileva Noplag?
- Al lancio, la copertura include: ChatGPT (gpt-4o, o1, o3), Claude (Sonnet / Opus / Haiku, 3.x e 4.x), Gemini (1.5 / 2.0 / 2.5), GPT-5, Llama 3.x. Arriva presto; qualità variabile per modello, con report che specifica la corrispondenza della firma.
- Cosa cambia rispetto a GPTZero o Originality.ai?
- Offriamo rilevamento AI insieme al controllo del plagio e distribuiamo il motore come open source. GPTZero rileva solo AI. Originality.ai è closed-source e non pubblica i dati sul bias verso chi parla inglese come seconda lingua. Consulta /vs-gptzero e /vs-originality-ai per confronti dettagliati.
- Gli studenti possono aggirare questo rilevatore con un umanizzatore?
- Sì — gli umanizzatori esistono e va ammesso. Una riscrittura maggiore dopo la bozza LLM abbassa il segnale. Non forniamo un umanizzatore (contrario alla nostra mission). Rilevamento AI come uno fra più segnali, mai come verdetto.
- Cosa significa 'falso positivo' qui?
- Testo scritto da una persona valutato come generato da AI. Misureremo e pubblicheremo il tasso per lingua e cluster di stile di scrittura. Nessun rilevatore ha tasso zero — considerare un punteggio alto come prova anziché come segnale da approfondire è l’uso scorretto che questa pagina intende scoraggiare.
- Vendete garanzie di 'rilevamento al 99%'?
- No. Chiunque dichiari un’accuratezza sostenuta superiore a circa l’85% su stili di scrittura, lingue e LLM diversi, presenta dati in modo fuorviante rispetto ai limiti matematici. Pubblicheremo l’effettivo intervallo di confidenza per lingua quando la funzionalità supera la valutazione. Non vendiamo certezze.
- Il rilevamento AI è gratuito?
- È in arrivo. Al lancio sarà incluso nel piano gratuito — lo stesso limite di 2.500 parole del check plagio. I piani a pagamento alzano la soglia; rilevamento AI non sarà mai dietro un addon separato.
- Quanto è aggiornata la copertura dei modelli?
- Calibrazione aggiornata entro 30 giorni da ogni nuovo LLM. Se il modello non è ancora incluso, il report indica 'probabile LLM, modello sconosciuto' invece di inserire una famiglia a caso.
- Gestite il rilevamento AI multilingue?
- Inglese, spagnolo, francese, tedesco e portoghese hanno calibrazione validata — inglese segnale più forte. Altre lingue danno 'low-resource — usare cautela'. Il report indica il livello di calibrazione usato.
- Posso integrare il rilevamento AI tramite API?
- Presto. È in roadmap; quando sarà attivo, l’endpoint /v1/checks restituirà sia score plagio che score AI. Veda /plagiarism-checker-api e /docs/api.
- Che succede se non concordo con uno score?
- Ce lo comunichi. Registriamo le correzioni, riaddestriamo entro 30 giorni da ogni rilascio, e pubblichiamo i cambiamenti comportamentali. Rilevamento non è perfetto; meglio ricevere le segnalazioni di errore che fingere non esistano.
Rilevamento AI — in arrivo, gratis fino a 2.500 parole.
Dati di calibrazione, tassi di falsi positivi e firme per modello verranno pubblicati. Veda cosa c’è dietro ogni punteggio prima di agire.
Mi avvisi quando sarà attivo