TESI DI DOTTORATOControlli su 50.000 parole · riconosce autocitazione

Antiplagio tesi di dottorato con autocitazioni

Controlli la tua tesi prima della discussione. Il livello Premium gestisce 50.000 parole in un solo controllo. Autocitazione tra capitoli segnalata come SELF-CITE (legittima a questa lunghezza, non è un plagio). Riconosce embargo per capitoli già pubblicati come articoli in dottorato cumulativo. Endpoint UE per ricerca su dati primari sensibili.

0 / 1,500 words
Fino a 50.000 paroleAutocitazione tra capitoliResidenza UE · Revisione etica possibile
PERCHÉ LE TESI DI DOTTORATO SERVONO REGOLE PROPRIE

Quattro cose su un documento da 60.000 parole che uno strumento per saggi da 1.500 parole sbaglia.

Il classificatore è regolato per testi accademici lunghi: l’autocitazione tra capitoli è normale, l’esclusione automatica della bibliografia è essenziale, e il report deve poter essere riprodotto mesi dopo davanti alla commissione.

01 · LUNGHEZZA

Controllo di 50.000 parole in una passata

Premium gestisce una tesi tipica (60.000–80.000 parole) a blocchi di 50.000 parole per passata — due controlli coprono quasi sempre l’intera tesi. Di solito si lavora per capitolo durante la scrittura. Il livello gratuito (2.500 parole) copre solo un estratto: utile per un controllo veloce, non per la tesi intera.

02 · AUTOCITAZIONE

Il suo lavoro precedente è atteso

I dottorati cumulativi includono esplicitamente articoli già pubblicati come capitoli. Aggiunga il suo ORCID + elenco DOI in allowlist; il motore segnala questi intervalli come SELF-CITE e li esclude dal totale. Stessa regola per brani ripresi da tesi di laurea magistrale o pubblicazioni per l’ammissione.

03 · ESCLUSIONE BIBLIOGRAFIA

100+ riferimenti non gonfiano il punteggio

Bibliografia esclusa in automatico (riconosciuta da intestazione + formato). Con queste lunghezze può avere anche 150–400 fonti citate; segnalare la bibliografia alzerebbe la percentuale headline al 18–22% prima ancora di iniziare. Noi non lo facciamo.

04 · TEMPO DI SCRITTURA

Bozze su 3–5 anni di lavoro

Commit del motore + snapshot del corpus segnati in ogni report. Ripeta il controllo sullo stesso capitolo dopo due anni rispetto allo stesso commit: il risultato si riproduce identico. Il suo controllo fatto a gennaio 2024 funzionerà ancora per la discussione in ottobre 2026 — e il report è verificabile anche mesi dopo.

IL TIMING DELLA TESI

Tre tappe chiave. Il controllo si adatta a ciascuna.

Quasi tutti i dottorati seguono lo stesso schema: scrittura dei capitoli → assemblaggio tesi completa → preparazione della discussione. Il controllo serve a ogni fase in modo diverso.

01

01 · Bozze di capitolo (mesi 1–24)

Controlli ogni capitolo man mano che lo termina. Individui parafrasi non citate prima che il relatore legga il capitolo 2 per la terza volta. Usi allowlist (ORCID + DOI co-autori) così l’autocitazione legittima tra lavori precedenti non alza il punteggio. Può fare molte revisioni senza consumare crediti singoli — Premium a quota fissa: decine di revisioni senza costi aggiuntivi.

02

02 · Assemblaggio tesi completa (mesi 24–32)

Controlli la tesi intera (Premium: 50.000 parole alla volta; per una tesi da 80.000 parole, due controlli bastano). Bibliografia esclusa automaticamente. L’autocitazione tra capitoli individua passaggi riscritti nel capitolo 5 provenienti dal 2 — a volte legittimo, a volte segno che occorre rivedere la bozza.

03

03 · Preparazione discussione (mesi 33–36)

Ripeta il controllo finale usando lo stesso commit engine dei report precedenti — risultato identico. Stampi il report per intervallo; lo porti alla discussione. Se la commissione le chiede “questo brano sembra il suo articolo del 2022” il report mostra già SELF-CITE con DOI. Riproducibile anche mesi dopo per eventuali revisioni post-difesa.

GESTIONE AUTOPLAGIO

Sei casi di "riciclo del proprio lavoro" — nessuno di questi fa fallire la discussione.

Chi scrive il dottorato riutilizza legittimamente testo da pubblicazioni precedenti, atti di conferenze, esami di ammissione, tesi di master. Il classificatore separa i casi attesi da quelli che all'istituzione interessa davvero segnalare.

01 · ARTICOLI GIÀ PUBBLICATI

I suoi articoli scientifici (allowlist via ORCID + DOI). I dottorati cumulativi includono esplicitamente questi come capitoli — marcati SELF-CITE, esclusi dal totale. Alcune riviste richiedono esplicita attribuzione; il classificatore segnala i punti dove serve una nota "questo capitolo è basato su...".

02 · ATTI DI CONFERENZA

Aggiunga i DOI dei lavori da conferenza (o URL ACM/IEEE/ACL) a allowlist. Comune nei dottorati: un paper da conferenza di solito è l’origine di un capitolo. Marcato come SELF-CITE-CONF; alcune istituzioni lo permettono con attribuzione, altre chiedono rielaborazione. Il report mostra dove avviene il riciclo.

03 · TESI DI MASTER

Aggiunga l’URL della tesi (repository istituzionale, spesso ProQuest o biblioteca universitaria) alla allowlist. I capitoli di contesto spesso riprendono struttura da master a dottorato. Marcato come SELF-CITE-MASTERS; alcune istituzioni permettono, altre richiedono dichiarazione esplicita in prefazione.

04 · QUALIFYING / COMPS

Alcune istituzioni permettono di inserire materiali di esami/tesine/proposte nella tesi; altre impongono la riscrittura totale. Il classificatore segnala questi passaggi riciclati; la politica la stabilisce la direzione del corso, non il motore.

05 · CAPITOLI CO-FIRMATI

Alcune tesi includono lavori co-firmati come capitoli. Aggiunga l’ORCID del co-autore a allowlist; gli intervalli corrispondenti sono CO-SELF-CITE. In genere serve una nota che indica il suo contributo specifico (di solito una dichiarazione CRediT). Il report mostra la provenienza dei brani co-firmati.

06 · RICICLO NON ATTRIBUITO

Il caso davvero problematico: passaggi riutilizzati da propri lavori precedenti senza attribuzione — anche da bozze non pubblicate. Contano per intero sul totale. Anche l’autoriciclo va dichiarato; quasi tutte le istituzioni considerano l’autoplagio non dichiarato una mancanza di integrità, anche se il lavoro era suo.

IL REPORT DI CAPITOLO

Com’è un report durante la scrittura.

Classificazione per-paragrafo con DOI delle fonti. Il valore totale riflette solo le categorie non attribuite. Riproducibile con lo stesso commit mesi dopo.

TESI DI DOTTORATO · CAPITOLO 4 · 8.420 parole · 64 intervalli · allowlist attivaCapitolo 4: Apprendimento statistico su grafi rumorosi
Totale · 3,2%SELF-CITE · 24%v0.4.2
#INTERVALLO · FONTECLASSIFICAZIONE
08
Definiamo un grafo rumoroso come una tripla (V, E, p) dove p assegna a ogni arco una probabilità di corruzione indipendente.Suo articolo NeurIPS 2023, §2.1 · ORCID + DOI in allowlist · capitolo da dottorato cumulativo
SELF-CITE
12
I recenti progressi sulle reti neurali per grafi si sono focalizzati sulla stabilità alle perturbazioni strutturali (Kim et al. 2022).openalex.org/W93b · citazione + (Kim et al. 2022) presente
PARA·CITED
14
Il gap spettrale di Laplace controlla la velocità di diffusione dell’informazione nella rete.Hammond et al. (2011), p.142 — già citato 4 paragrafi sopra, il classificatore rileva attribuzione continua
PARA·CITED
19
Adottiamo la convenzione che i pesi sugli archi sono non negativi e il grafo è non orientato.Formula generica · corrisponde a 2.300+ articoli di teoria dei grafi — frase standard
COMMON-KNOWLEDGE
23
La robustezza al rumore delle etichette è essenziale per portare le tecniche di classificazione semi-supervisionate nel mondo reale.Articolo co-autore Zhang su ACL 2023 · allowlist tramite ORCID co-autore · capitolo cofirmato
CO-SELF-CITE
28
L’algoritmo converge a un minimo locale in O(n log n) passi sotto le nostre ipotesi.Suo report tecnico non pubblicato (feb 2024) — non in allowlist, nessuna attribuzione in questa sezione
UNATTRIBUTED
41
Bibliografia — Kim, Hammond, Zhang e altri 187.Sezione referenze, pp. 240–248
REFS · EXCLUDED
Totale 3,2% = solo materiale non attribuito. SELF-CITE + CO-SELF-CITE + CITED + COMMON + REFS tutti esclusi.Motore v0.4.2 · Esporta PDF · Riproducibile a discussione
50.000parole per controllo (Premium)
700M+opere accademiche indicizzate
6categorie autocitazione
5lingue riconosciute al lancio
UEresidenza · revisione etica possibile
DOVE NON EQUIVALIAMO ITHENTICATE

Due limiti da segnalare apertamente per chi scrive il dottorato.

01 · GAP PROQUEST

Il database tesi richiesto dalla disciplina

iThenticate integra il database ProQuest delle tesi (~5M tesi statunitensi); noi non abbiamo accesso. Se la commissione vuole il confronto con tesi USA precedenti, iThenticate è lo strumento adatto a quel caso. Noi copriamo ~700M pubblicazioni open-access (più ampio sugli articoli, meno sulle vecchie tesi). È un limite dichiarato.

Confronto con iThenticate
02 · OBBLIGO DI JOURNAL

Quando la rivista richiede iThenticate per la submission

Alcune riviste (Nature, Cell, NEJM, Elsevier) usano iThenticate durante la submission tramite Crossref Similarity Check. Avviene comunque, indipendentemente dal controllo che fa lei prima — non si può sostituire. Questo è il senso di Noplag: l’autoverifica sulle bozze prima di arrivare a submission, dove i crediti a documento di iThenticate (125$ ognuno) renderebbero proibitivo il flusso iterativo. Usi entrambi.

Guida al workflow
PRONTO PER LA DISCUSSIONE

Riproducibile anche mesi dopo. Porti il report stampato alla discussione.

Ogni report indica il commit del motore (es. v0.4.2) e il timestamp dello snapshot del corpus. Se ripeti l’analisi dello stesso capitolo contro quel commit dopo due anni, il risultato sarà identico — nessun retraining silenzioso, nessuna sorpresa di “algoritmo cambiato” durante la discussione. La classificazione di ogni intervallo è verificabile: il tag SELF-CITE rimanda al DOI della fonte; il tag CITED rimanda al paragrafo corrispondente; il tag UNATTRIBUTED rimanda all’URL della fonte originale. Apache 2.0 su github.com/NoplagLabs/noplag-engine — la commissione può consultare la logica delle soglie, la calibrazione AI, le regole di deduplicazione. I rilevatori closed-source non garantiscono questo: il loro report dipende dall’algoritmo attivo il giorno del controllo; se il modello è stato aggiornato, il report portato in discussione potrebbe non essere più riproducibile. Il nostro sì.

Guida alla discussione
CHECKLIST TESI DI DOTTORATO
ALLOWAggiunga ORCID + elenco DOI dei suoi articoli precedenti · atti di conferenza · tesi di master · ORCID co-autori
BIBBibliografia individuata tramite intestazione + formato. Totalmente esclusa. I riferimenti non pesano sul totale.
CHAPTControllo per capitolo durante la stesura. Intera tesi durante l’assemblaggio. Passaggio finale prima della discussione. Stesso motore, stesso formato report.
COMMITOgni report riporta commit engine + snapshot corpus. Riproducibile anche anni dopo.
EUEndpoint UE per dati primari sensibili. Self-hosting all’interno dell’istituzione se richiesto da IRB.
DOIOgni intervallo fornito arriva con DOI fonte · URL canonico · timestamp snapshot. Consultabile da chiunque in commissione.
FAQ

Domande che i dottorandi fanno davvero.

Posso controllare tutta la tesi insieme o devo dividerla?
Premium gestisce fino a 50.000 parole per controllo. Per una tesi tipica da 60.000–80.000 parole, due passate bastano (capitoli 1-4, poi 5-8) o quattro se si vuole il dettaglio per capitolo. La verifica per capitolo è la regola nella stesura; il controllo intero si usa in fase di assemblaggio finale e preparazione discussione.
Come funziona davvero la allowlist per autocitazione?
Inserisca il suo ORCID in allowlist; il motore recupera i DOI tramite public API ORCID. Aggiunga manualmente i DOI di conference/master/co-autori. Le corrispondenze con allowlist diventano SELF-CITE, CO-SELF-CITE o SELF-CITE-MASTERS — escluse dal totale. Così evita di dover discutere su “ma è materiale mio” durante la discussione.
E le tesi ProQuest? Voi non le avete.
Corretto, limite dichiarato. Il database ProQuest delle tesi (~5M dottorati USA) è a pagamento, non incluso in OpenAlex/CORE. Se la commissione vuole confronto con tesi dottorali USA, iThenticate ha il dataset che noi non copriamo. Noi: ~700M pubblicazioni open-access (più copertura per articoli, meno per vecchie tesi).
Le bozze di capitolo vengono archiviate o usate per allenare AI?
No. Le bozze sono fingerprint (hash non reversibili) in database isolato per tenant. Il testo originale si cancella dopo 30 giorni salvo volontà esplicita di tenere le bozze (scelta comune tra chi scrive tesi). I modelli sono pre-addestrati su corpora pubblici; nessun manoscritto candidato va nei dati di training. Esplicitato nel DPA.
Riproducibilità alla discussione — in pratica?
Ogni report marca commit engine (es. v0.4.2) + timestamp snapshot corpus. Se salva il controllo di gennaio 2024 e lo ripete a ottobre 2026 contro v0.4.2, il giudizio è identico. Ogni intervallo verificabile: SELF-CITE → DOI; CITED → paragrafo match; UNATTRIBUTED → URL fonte. I checker closed-source non lo garantiscono: il report cambia col modello.
Se la tesi contiene dati sensibili/pazienti/classificati. Posso installare in sede?
Sì. Apache 2.0 + Docker, tutto gira sulla rete dell’istituzione. Nessun traffico esterno. Utile con dati clinici, sotto IRB, materiale protetto o con imposizione di archiviazione interna. Il motore lavora offline con i dati indicizzati; il layer online resta opzionale.
Come sarà il rilevamento AI su un documento misto AI/persona di 60.000 parole?
La rilevazione AI arriverà — roadmap, non attiva al lancio. È previsto un output per paragrafo (Binoculars, Hans et al. 2024). Il responso sarà per paragrafo, non per documento — un capitolo scritto con Grammarly e poi riscritto a mano sarà valutato in modo diverso a seconda della sezione. Un intervallo specifico per non-native English a seconda della firma lessicale. Metodo open-source: difendibile a discussione.
E i dottorati cumulativi — i capitoli da articoli sono ammessi?
Molte università li permettono (Germania, Olanda, Scandinavia; anche UK/USA sempre più spesso). Le riviste spesso permettono il riuso in tesi con attribuzione. Si aggiungono i DOI pubblicati nella allowlist; il motore segnala SELF-CITE. La regola la stabilisce la policy dell’istituzione e della rivista.
Se il relatore/commissione mette in dubbio una segnalazione?
Ogni intervallo segnalato riporta DOI della fonte, URL canonico, timestamp dello snapshot e commit del motore. Puoi confrontare la fonte originale affiancata e mostrare la logica di classificazione per intervallo. Il motore è Apache 2.0 su github.com/NoplagLabs/noplag-engine — la commissione può leggere la logica delle soglie riga per riga. Questo significa davvero “difendibile”: citazione della metodologia, risultato riproducibile, algoritmo aperto.
Quanto costa per 3–5 anni di lavoro?
Premium 79$/mese controlli illimitati in fase di scrittura; può disdire e riattivare secondo necessità (le cartelle restano). Di solito bastano 6–12 mesi Premium in 4 anni, in pausa nei periodi in cui non scrive. La quota fissa conta: i crediti per documento (iThenticate 125$/doc) costerebbero migliaia sulle centinaia di revisioni.

Controlli un capitolo. Porti il report alla discussione.

Incolli una bozza in Noplag. Aggiunga il suo ORCID. Vede le categorie SELF-CITE, CITED, UNATTRIBUTED. Il livello gratuito copre 2.500 parole per un controllo sezionale; Premium 79$/mese gestisce 50.000 parole per revisione su intera tesi.

Antiplagio tesi di dottorato con gestione autocitazioni