POSIZIONERilevazione — non generazione.

Rilevatore di parafrasi — individua copie camuffate

Un rilevatore di parafrasi individua testi riformulati per nascondere la fonte. Noplag oggi rileva solo i casi più semplici: modifiche che lasciano intatte sequenze di cinque parole vengono ancora riconosciute, quindi sostituzioni di sinonimi e piccoli riordini vengono trovati tramite impronte winnowing e verifica con ricerca web in tempo reale. La riscrittura approfondita frase per frase è un problema diverso e non la rileviamo ancora — il matching di quasi-duplicati (v1.1) e il matching semantico (v1.2) sono le soluzioni previste, disponibili quando supereranno la valutazione pubblica.

0 / 1,500 words
Individua riformulazioni leggereMotore open sourceChiari su ciò che non rileva
LA NOSTRA POSIZIONE

Noi rileviamo. Non aiutiamo a eludere.

Un humanizer è uno strumento che riscrive testi generati da AI o da persone per evitare la rilevazione. Potremmo svilupparne uno. Non lo facciamo. Lo scopo di questo prodotto è individuare copie non attribuite, non aiutare a nasconderle. Se la rilevazione deve essere utile, chi sviluppa rilevatori e chi crea humanizer non può essere lo stesso fornitore. Abbiamo scelto la nostra posizione.

Quando menzioniamo gli humanizer nel report, è per segnalare che esistono e che potrebbero essere stati usati a monte del testo che stai verificando — non per venderli.

STRUMENTI CON CUI NON COMPETIAMO
QuillbotUndetectableStealthGPTHumbotAIHumanizeWalter Writes
COME FUNZIONA IL RILEVAMENTO SEMANTICO

Quattro livelli. Due disponibili, due in sviluppo.

La cascata restringe il controllo: da corrispondenze esatte, passando per quasi-duplicati, fino all’equivalenza semantica, con verifica incrociata sul web aperto. Due di questi livelli sono inclusi nella v1.0; i due che gestiscono il vero riconoscimento di parafrasi sono ancora in sviluppo, e preferiamo dichiararlo apertamente.

L1

Winnowing fingerprints — disponibile

RILEVA

Corrispondenze esatte di sottostringhe. Sostituzioni leggere di sinonimi e piccoli riordini che mantengono sequenze di cinque parole.

NON RILEVA

Qualsiasi testo riordinato o riformulato.

L2

MinHash LSH — roadmap v1.1

RILEVA

Rileverà riordino di frasi e rimescolamento a livello di parola. Non rilevato oggi.

NON RILEVA

Vere sostituzioni di sinonimi e riscritture semantiche, che saranno gestite dal livello L3.

L3

Sentence embeddings — roadmap v1.2

RILEVA

Rileverà sostituzioni di sinonimi e parafrasi semantiche. Non rilevato oggi.

NON RILEVA

Riscritture abbastanza distanti dalla fonte da non lasciare segnali statistici.

LW

Controllo incrociato sul web in tempo reale — disponibile

RILEVA

Fonti emerse dopo l’istantanea del corpus.

NON RILEVA

Contenuti a pagamento o non indicizzati.

COPERTURA DELLA RILEVAZIONE

Cosa rileviamo oggi — in base all’intensità della parafrasi.

Questo è il comportamento della v1.0, non una previsione. Una revisione leggera lascia ancora sequenze di testo rilevabili; una riscrittura approfondita no, e nessun tipo di fingerprinting le recupera. Abbiamo descritto esattamente dove cade questa soglia nel nostro post sui limiti reali della rilevazione letterale: /blog/the-honest-limits-of-verbatim-detection.

LEGGERA
nella v1.0 attuale

Sostituzioni di sinonimi e piccoli cambiamenti nell’ordine. Abbastanza testo originale rimane per consentire la corrispondenza delle impronte.

ORIGINALE

Il gatto si è seduto sul tappeto.

PARAFRASATO

Il felino si è seduto sul tappeto.

MODERATA
Parzialmentenella v1.0 attuale

Frase ristrutturata, verbi modificati. Rilevato solo dove sopravvive una sequenza invariata. Il matching di quasi-duplicati (v1.1) è pensato per questo livello.

ORIGINALE

Il gatto si è seduto sul tappeto.

PARAFRASATO

Sul tappeto, il gatto si era sistemato.

PESANTE
Nonella v1.0 attuale

Riscrittura completa del significato, nuova struttura e nuovo lessico. Oggi il punteggio è zero; il matching semantico (v1.2) è previsto per questo livello.

ORIGINALE

Il gatto si è seduto sul tappeto.

PARAFRASATO

Un piccolo mammifero si era posizionato su una superficie in tessuto.

DOMANDE FREQUENTI

Dieci domande sulla rilevazione del testo parafrasato.

Prevalentemente su dove la rilevazione fallisce. Siamo espliciti sui limiti; chi deve saperlo sono coloro che prendono decisioni in base al punteggio.

Qual è la differenza tra rilevare una parafrasi e rilevare un plagio?
Il plagio è la categoria più ampia: copiare un testo senza citarne la fonte. La rilevazione della parafrasi è la sfida specifica di individuare il plagio dopo che il testo è stato riscritto per mascherarne l’origine. Noplag esegue entrambe le analisi in un unico report; il modulo di rilevazione della parafrasi interviene quando il livello L1 di corrispondenza esatta non rileva nulla.
Perché è così difficile individuare una parafrasi pesante?
La rilevazione si basa sull’individuazione di segnali statistici: sequenze di parole condivise, poi struttura e significato condivisi. Una modifica leggera lascia intatte queste sequenze, quindi viene rilevata. Se si riscrive un passaggio frase per frase, le sequenze condivise scompaiono: una parafrasi accurata ottiene punteggio zero con un motore di fingerprinting, che è ciò che fa la v1.0. È una caratteristica del metodo, non un errore, ed è il motivo per cui il matching near-duplicate (v1.1) e semantico (v1.2) sono livelli separati e non semplici regolazioni. Abbiamo descritto questi limiti nel nostro post sui limiti onesti della rilevazione letterale: /blog/the-honest-limits-of-verbatim-detection.
Noplag offre uno strumento per umanizzare testi AI?
No. Non forniamo un humanizer. Un humanizer serve a eludere la rilevazione — è contrario alla nostra missione. Siamo dalla parte dell’integrità: rileviamo, non aiutiamo a nascondere. Vedi la posizione sopra.
Come si confronta questo con lo strumento di parafrasi di Quillbot?
Quillbot riscrive i testi per eludere la rilevazione. Noi rileviamo testi riscritti per sfuggire al controllo. Siamo agli estremi opposti dello stesso problema. Se un output di Quillbot viene analizzato, il report segnala 'possibile uso di strumento di parafrasi' quando rileviamo la firma.
Cos’è una 'cascata a quattro livelli' e quali sono già attivi?
Quattro passaggi di rilevazione, ognuno meno letterale del precedente. L1 winnowing rileva corrispondenze esatte e modifiche leggere, Layer W verifica tramite ricerca web in tempo reale — entrambi disponibili in v1.0. L2 (matching near-duplicate) è previsto nella roadmap per v1.1 e L3 (matching semantico tramite sentence embeddings) per v1.2; nessuno dei due è attivo oggi né presente nel repository pubblico. In sintesi: metà della cascata è attiva, ed è quella che gestisce le riformulazioni leggere.
E la back-translation come tecnica di parafrasi?
La back-translation (inglese → spagnolo → inglese) è tra le parafrasi più difficili da rilevare: semanticamente equivalente ma strutturalmente nuova. Dove lascia intatte sequenze dell’originale la rileviamo; dove la riscrittura è completa oggi non la rileviamo. È un obiettivo per il livello semantico in v1.2.
Segnalerete la parafrasi pesante come 'plagio'?
Solo se la confidenza è sufficientemente alta. Sotto la soglia mostriamo il passaggio sospetto come 'corrispondenza a bassa confidenza' e lasciamo la valutazione al revisore. Non dichiariamo mai unilateralmente una parafrasi come plagio: riportiamo una probabilità e la motivazione.
Posso vedere come Noplag ha valutato un passaggio?
Sì. Ogni corrispondenza nel report collega all’URL della fonte e mostra quale livello di rilevazione è intervenuto. Puoi replicare il punteggio offline tramite il motore open source — vedi /open-source-plagiarism-checker.
Noplag rileva parafrasi anche in lingue diverse dall’inglese?
La rilevazione è calibrata per inglese, spagnolo, portoghese, polacco e ucraino al lancio, con altre lingue in arrivo. Le altre lingue restituiscono risultati segnalati come 'low-resource — interpretare con particolare cautela.'
Il rilevatore di parafrasi è gratuito?
Sì, nel piano gratuito — 2.500 parole per verifica, senza registrazione. I piani Pro e Premium aumentano il limite; l’algoritmo di rilevazione è lo stesso per tutti i piani.

Trova plagio parafrasato — gratis, fino a 2.500 parole.

Oggi rileviamo solo riformulazioni leggere e dichiariamo chiaramente che le riscritture approfondite non vengono individuate finché non saranno disponibili i livelli semantici. Esegui un controllo sul tuo testo e leggi cosa ha effettivamente rilevato il motore.

Individua plagio parafrasato
Rilevatore di Parafrasi — Individua Plagio Riformulato | Noplag