Verificare plagiat pentru cercetători pre-susținere
Verifică manuscrisele pre-publicare față de peste 700M de lucrări academice. My Folders urmărește publicațiile proprii anterioare, pentru ca auto-citarea legitimă să nu crească scorul. Punct final cu rezidență UE pentru cercetările sensibile. Motor Apache 2.0 — auditabil IRB.
Patru roluri de cercetare. Un workflow unic de auto-verificare.
Capitol de teză înainte de predare
Iterați pe capitole. Monitorizați auto-citarea între versiuni.
- Verificare pe capitol + istoric versiuni
- Allowlist pentru auto-citare (propriul ORCID + lista de DOIs)
- Bibliografia exclusă automat
Manuscris înainte de trimiterea la jurnal
iThenticate rulează la predare; noi verificăm înainte.
- Index academic open-access de peste 700M lucrări
- Clasificare citare (citare vs parafrazare necitată)
- Abonament Pro cu tarif fix · fără cost per verificare
Review de literatură + verificare propunere
Refolosirea textelor anterioare din granturi e normală — semnalizăm.
- Recunoaște publicațiile și granturile proprii anterioare
- Allowlist co-autori (lucrări anterioare ale colaboratorilor)
- Export raport de clasificare PDF pentru colaboratori
QA pre-publicare la nivel de laborator
Detectează problemele pentru toate manuscrisele lab-ului într-o singură coadă.
- Folder per proiect + per postdoc
- Rezidență UE pentru date clinice / sensibile
- Motor Apache 2.0 — justificabil la audit IRB
Trei pași înainte ca manuscrisul să ajungă la jurnal.
Rulați iterativ. Identificați intervalele auto-citate ca să nu crească scorul iThenticate / Crossref la predare. Verdicturile AI apar în curând, deci puteți face o previzualizare înainte ca reviewer 2 să ridice subiectul.
01 · Schiță + allowlist
Încărcați schița capitolului sau manuscrisului. Adăugați ORCID și lista de DOIs (allowlist) — publicațiile proprii se marchează SELF-CITE, nu plagiat. DOIs ale co-autorilor incluse dacă ați colaborat; motorul recunoaște reciclarea legitimă.
02 · Rulați cascada
L1 winnowing → live-web astăzi, urmat de L2 MinHash (v1.1) și L3 vector embeddings (v1.2). Detectează copierea integrală și aproape integrală; detectarea parafrazării va fi disponibilă odată cu L2 și L3. Clasificarea citărilor separă materialul citat de parafrazarea fără citare. Suport multilingv, cu detecție calibrată pentru engleză, spaniolă, portugheză, poloneză și ucraineană la lansare, urmând să fie adăugate și alte limbi. Mediana: 47 de secunde per manuscris.
03 · Revizuire + iterație
Raportul marchează intervalele pe categorii: SELF-CITE (propriu, așteptat), CITED (citat cu atribuire, așteptat), CITED-PARA (parafrazare cu citare, scor scăzut), UNCITED-PARA (necesită atenție), AI-LIKELY (care va include și bandă ajustată ESL) în curând. Reproducibil — commit motor + snapshot corpus pe fiecare raport.
Șase categorii de reciclare legitimă — niciuna nu crește scorul.
Verificatoarele black-box semnalează orice potrivire drept plagiat. Cercetătorii reciclează text legitim frecvent. Iată cum clasează classifier-ul.
01 · PROPRIILE LUCRĂRI
Allowlist ORCID + DOI. Lucrările publicate anterior sunt marcate SELF-CITE, nu plagiat. Frecvent în review-uri (“cum am arătat în Chen 2023…”) sau propuneri de grant unde dezvoltați pe lucrări proprii.
02 · ARTICOLE CO-AUTOR
Adăugați ORCID-urile colaboratorilor la allowlist. Articolele co-autori sunt marcate CO-CITE. Util atunci când manuscrisul extinde o lucrare scrisă cu un colaborator — secțiunile standard la metode pot fi legitim refolosite.
03 · TEXT LABORATOR MOȘTENIT
Corp comun PI-folder: secțiuni standard, protocoale, declarații de etică replicate în publicațiile lab-ului. Se marchează LAB-CITE și nu intră în scor. Boilerplate-ul aprobat IRB nu trebuie rescris la fiecare lucrare.
04 · PRE-PRINTURI CU EMBARGO
Propriul arXiv / bioRxiv pre-print pentru manuscrisul curent. Classifier-ul detectează tranziția pre-print → versiune jurnal și marchează PREPRINT-SELF. Nu influențează scorul. Jurnalele care interzic explicit pre-printurile pot seta reguli mai stricte.
05 · CITĂRI RETRASE
Integrarea Crossref Retraction Watch marchează orice interval găsit care citează lucrări retrase. Nu modifică scorul de similaritate — dar este util să știți înainte de predare. Prinde problema “am citat un articol care a fost retras luna trecută”.
06 · IRB / SENSIBIL
Punct finrezidență UE (api.eu.noplag.com) păstrează manuscrisul numai pe infrastructură UE. Puteți auto-găzdui motorul intern pentru manuscript cu HIPAA / GDPR / date pacienți. Apache 2.0 + Docker; datele nu părăsesc VPC-ul.
Organizat pe proiect. Audit-trail pe date.
Grupați manuscrisele pe proiect, an laborator sau ciclu de grant. Reluați verificări pe același commit al motorului oricând — rapoartele pot fi reproduse la luni distanță.
Trei cerințe esențiale pentru verificarea manuscriselor sensibile.
Manuscrisele rămân pe infrastructură UE
Pro+ pe api.eu.noplag.com. Găzduit pe data centere Hetzner localizate UE (Falkenstein + Helsinki). Submisia, store-ul de amprente și raportul nu ies din spațiul UE. GDPR implicit; DPA la cerere.
Rulează motorul la instituția dvs
Apache 2.0 + Docker compose. Fluxul complet rulează doar pe infrastructura dvs. Aduceți propriul Postgres + Redis; corpusul apare ca bundle indexabil în Enterprise. Nicio dată nu iese din VPC. Corect pentru date clinice, studii pacienți sau cercetare sensibilă.
Ștergeți fiecare amprentă pe care o deținem pentru contul dvs
Un click în Setări. În 24h, orice amprentă, raport, allowlist sau metadată asociată contului este ștearsă. Conform GDPR Articolul 17. Utilizatorii self-host au acces direct la bază; cloud — au endpoint de ștergere documentat.
Un motor Apache 2.0 pe care IRB-ul chiar îl poate analiza concret.
Recenziile instituționale pe softuri de detectat plagiat stagnează pe aceleași întrebări: unde ajunge manuscrisul după predare, cum funcționează algoritmul, dacă date sensibile/pacient ies, cum se realizează ștergerea efectivă, și dacă scorurile de acuratețe pot fi reproduse. La vendorii închiși, întrebările primesc răspuns doar în contact de vânzare. Apache 2.0 permite IRB-ului să cloneze repo-ul, să ruleze motorul pe sandbox, să auditeze fluxul de date, să testeze cap-coadă ștergerea, și să verifice F1 publicat pe corpus propriu. Nu promitem review mai ieftin — ci unul ce se poate chiar finaliza. De asta office-urile de date care refuzau alți furnizori aprobă acest motor.
Citiți ghidul de audit IRBÎntrebările puse real de office-ul de cercetare.
- De ce îmi schimbă scorul lista ORCID + DOI?
- Pentru că motorul reclasifică orice fragment care se potrivește cu allowlistul ca SELF-CITE, nu UNCITED-PARA. Potrivirile nu dispar — doar marcate diferit. SELF-CITE aproape nu contează la scorul principal. Matematic: dacă citez de 2x pre-print personal și 1x lucrare anterioară coautor — acestea 3 trec din “numărate” la “reciclare academică legitimă”.
- Se antrenează motorul pe manuscrisele încărcate?
- Nu. Textul încărcat e fingerprintat (doar hashes, ireversibil) și stocat în baza izolată a utilizatorului. Textul se șterge după 30 zile daca nu activați retenția. Detectorul AI Binoculars care urmează se antrenează doar pe corpusuri publice; nu adăugăm încărcările clienților la antrenare. Explicit în DPA.
- Ce se întâmplă cu pre-print-ul meu din arXiv / bioRxiv?
- Dacă includeți DOI-ul pre-printului pe allowlist, potrivirile se marchează PREPRINT-SELF și nu contează la scor. Motorul recunoaște evoluția pre-print → publicare. Jurnalele ce interzic explicit pre-printuri pot folosi allowlist mai strict — dar majoritatea (Nature, Cell, NEJM, PLOS) acceptă, iar SELF tagging se aliniază.
- Cum tratează detectorul AI co-autorii ESL?
- Detecția AI va fi disponibilă în curând — pe roadmap-ul v1.2. La lansare, folosește calibrare pe fiecare limbă și verdict ajustat pentru ESL. Dacă semnătura lexicală indică engleză non-nativă (frecvent în colaborări internaționale), verdictul va fi ESL ADJ cu eroarea reziduală documentată, nu o afirmație de zero. Articolul Liang et al. 2023 a raportat 61,3% FPR pe eseuri TOEFL pentru detectorii naivi; publicăm metodologia de reducere a riscului la /docs/developers/benchmarks. Coautorii ESL nu sunt marcați incorect.
- Pot rula motorul pe cluster Slurm pentru batch?
- Da — Apache 2.0 + Docker. Rulează containerul engine pe nodurile de calcul ale clusterului; preia date din filesystem-ul partajat; generează rapoarte JSON acolo unde pipeline-ul tău citește. Util pentru verificarea în lot a rezultatelor unui an de laborator față de ultimul snapshot de corpus. Exemplu de script Slurm sbatch la github.com/NoplagLabs/noplag-engine.
- Ce fac cu date clinice / manuscrise pacienți?
- Self-host pe VPC. Datele nu ies din rețea. Motorul nu cere internet pentru corpusul indexat (pierderea stratului live-web, dar nu obligatoriu). Compatibil HIPAA cu setup-ul corect; IT-ul dvs îl administrează ca orice serviciu intern.
- Cu ce diferă aici față de iThenticate la predare?
- iThenticate rulează la predare și vede editorul — nu puteți itera. Noplag e auto-verificarea înainte de predare. Cascada acoperă conținutul open-access (de fapt mai larg post-Plan-S); mai îngustă pe conținut academic licențiat/subscriptie unde iThenticate are acord. Manevrarea auto-citării e cheia — iThenticate nu o face bine.
- Se integrează cu managerul de referințe (Zotero / Mendeley / EndNote)?
- Allowlist-ul preia BibTeX, RIS, API ORCID direct. Exportați biblioteca din Zotero sau introduceți ORCID; allowlist-ul se populează cu DOIs în câteva secunde. Sync în timp real cu Mendeley + EndNote e pe roadmap-ul v1.2; pentru acum doar export.
- Cum stă cu acoperirea multilingvă pentru reviste non-engleză?
- Detecția este calibrată pentru engleză, spaniolă, portugheză, poloneză și ucraineană la lansare, cu alte limbi în curs de adăugare. Cea mai bună acuratețe pe limbile europene (istoric lung de calibrare). Calitatea detecției este evaluată pe PAN-PC-11; evaluarea pe fiecare limbă este pe roadmap. Util în special pentru mediile academice europene și sud-americane.
- Ce se întâmplă dacă un articol citat e retras după predare?
- Crossref Retraction Watch marchează pe fiecare re-verificare a manuscrisului. Dacă ați predat deja, anunțați editorul (unele jurnale cer gestionarea explicită a retragerii după predare). Scorul nu se modifică, dar știți înainte de reviewer 2.
Rulați un capitol prin cascadă. Vedeți clasificarea auto-citării.
Încărcați schița unui manuscris, capitol de teză sau review grant. Adăugați ORCID. Vedeți ce fragmente sunt SELF-CITE, CITED, UNCITED-PARA, și (în curând) AI-LIKELY. Gratuit până la 2.500 de cuvinte. Rezidență UE pe Pro+ pentru materiale sensibile.