RESEARCHPre-publicare · Recunoaște auto-citarea · Rezidență UE · Auditabil IRB

Verificare plagiat pentru cercetători pre-susținere

Verifică manuscrisele pre-publicare față de peste 700M de lucrări academice. My Folders urmărește publicațiile proprii anterioare, pentru ca auto-citarea legitimă să nu crească scorul. Punct final cu rezidență UE pentru cercetările sensibile. Motor Apache 2.0 — auditabil IRB.

Peste 700M de lucrări academiceAllowlist pentru auto-citareRezidență UE · Auditabil IRB
ORICÂND ÎN FLUXUL DE PUBLICARE

Patru roluri de cercetare. Un workflow unic de auto-verificare.

PHD / DOCTORAT

Capitol de teză înainte de predare

Iterați pe capitole. Monitorizați auto-citarea între versiuni.

  • Verificare pe capitol + istoric versiuni
  • Allowlist pentru auto-citare (propriul ORCID + lista de DOIs)
  • Bibliografia exclusă automat
POSTDOC

Manuscris înainte de trimiterea la jurnal

iThenticate rulează la predare; noi verificăm înainte.

  • Index academic open-access de peste 700M lucrări
  • Clasificare citare (citare vs parafrazare necitată)
  • Abonament Pro cu tarif fix · fără cost per verificare
SCRIITOR DE GRANT

Review de literatură + verificare propunere

Refolosirea textelor anterioare din granturi e normală — semnalizăm.

  • Recunoaște publicațiile și granturile proprii anterioare
  • Allowlist co-autori (lucrări anterioare ale colaboratorilor)
  • Export raport de clasificare PDF pentru colaboratori
LAB PI

QA pre-publicare la nivel de laborator

Detectează problemele pentru toate manuscrisele lab-ului într-o singură coadă.

  • Folder per proiect + per postdoc
  • Rezidență UE pentru date clinice / sensibile
  • Motor Apache 2.0 — justificabil la audit IRB
FLUX PRE-PUBLICARE

Trei pași înainte ca manuscrisul să ajungă la jurnal.

Rulați iterativ. Identificați intervalele auto-citate ca să nu crească scorul iThenticate / Crossref la predare. Verdicturile AI apar în curând, deci puteți face o previzualizare înainte ca reviewer 2 să ridice subiectul.

01

01 · Schiță + allowlist

Încărcați schița capitolului sau manuscrisului. Adăugați ORCID și lista de DOIs (allowlist) — publicațiile proprii se marchează SELF-CITE, nu plagiat. DOIs ale co-autorilor incluse dacă ați colaborat; motorul recunoaște reciclarea legitimă.

02

02 · Rulați cascada

L1 winnowing → live-web astăzi, urmat de L2 MinHash (v1.1) și L3 vector embeddings (v1.2). Detectează copierea integrală și aproape integrală; detectarea parafrazării va fi disponibilă odată cu L2 și L3. Clasificarea citărilor separă materialul citat de parafrazarea fără citare. Suport multilingv, cu detecție calibrată pentru engleză, spaniolă, portugheză, poloneză și ucraineană la lansare, urmând să fie adăugate și alte limbi. Mediana: 47 de secunde per manuscris.

03

03 · Revizuire + iterație

Raportul marchează intervalele pe categorii: SELF-CITE (propriu, așteptat), CITED (citat cu atribuire, așteptat), CITED-PARA (parafrazare cu citare, scor scăzut), UNCITED-PARA (necesită atenție), AI-LIKELY (care va include și bandă ajustată ESL) în curând. Reproducibil — commit motor + snapshot corpus pe fiecare raport.

GESTIONAREA AUTO-CITĂRII

Șase categorii de reciclare legitimă — niciuna nu crește scorul.

Verificatoarele black-box semnalează orice potrivire drept plagiat. Cercetătorii reciclează text legitim frecvent. Iată cum clasează classifier-ul.

01 · PROPRIILE LUCRĂRI

Allowlist ORCID + DOI. Lucrările publicate anterior sunt marcate SELF-CITE, nu plagiat. Frecvent în review-uri (“cum am arătat în Chen 2023…”) sau propuneri de grant unde dezvoltați pe lucrări proprii.

02 · ARTICOLE CO-AUTOR

Adăugați ORCID-urile colaboratorilor la allowlist. Articolele co-autori sunt marcate CO-CITE. Util atunci când manuscrisul extinde o lucrare scrisă cu un colaborator — secțiunile standard la metode pot fi legitim refolosite.

03 · TEXT LABORATOR MOȘTENIT

Corp comun PI-folder: secțiuni standard, protocoale, declarații de etică replicate în publicațiile lab-ului. Se marchează LAB-CITE și nu intră în scor. Boilerplate-ul aprobat IRB nu trebuie rescris la fiecare lucrare.

04 · PRE-PRINTURI CU EMBARGO

Propriul arXiv / bioRxiv pre-print pentru manuscrisul curent. Classifier-ul detectează tranziția pre-print → versiune jurnal și marchează PREPRINT-SELF. Nu influențează scorul. Jurnalele care interzic explicit pre-printurile pot seta reguli mai stricte.

05 · CITĂRI RETRASE

Integrarea Crossref Retraction Watch marchează orice interval găsit care citează lucrări retrase. Nu modifică scorul de similaritate — dar este util să știți înainte de predare. Prinde problema “am citat un articol care a fost retras luna trecută”.

06 · IRB / SENSIBIL

Punct finrezidență UE (api.eu.noplag.com) păstrează manuscrisul numai pe infrastructură UE. Puteți auto-găzdui motorul intern pentru manuscript cu HIPAA / GDPR / date pacienți. Apache 2.0 + Docker; datele nu părăsesc VPC-ul.

MY FOLDERS · VIZUALIZARE LAB

Organizat pe proiect. Audit-trail pe date.

Grupați manuscrisele pe proiect, an laborator sau ciclu de grant. Reluați verificări pe același commit al motorului oricând — rapoartele pot fi reproduse la luni distanță.

MY FOLDERS · Dr. Hirano lab · CompBio24 manuscrise · 6 proiecte
REZIDENȚĂ UEFolder nou
FOLDERDOCSULTIMA ACTIVITATEREGIUNE
Proiect: PD-L1 expression cohort8 manuscriseschiță v3 verificată · acum 2hUE
Proiect: synthetic-bio safety review5 manuscrisegata de predare · ieriUE
Grant: NIH R01 renovare Y33 manuscrisereview literatură v2 verificat · acum 2zUE
Text laborator: metode + etică4 docs · partajatelista laborator actualizată · acum 1sUE
Pre-printuri: arXiv în așteptare2 manuscrisePREPRINT-SELF marcat · acum 1sUE
Arhivat (2022–2024)12 articoleset referință auto-citareUE
Toate folderele cu rezidență UE · criptate pe disc · commit auditabil IRB pe fiecare raportreproducibilitate: motor v0.4.2 activ
700M+lucrări academice indexate
5limbi de detecție la lansare, extindere
UEpunct final rezidență disponibil
Apache2.0 · Auditabil IRB
Crossref+ Integrare Retraction Watch
PROTECȚIA DATELOR

Trei cerințe esențiale pentru verificarea manuscriselor sensibile.

01 · REZIDENȚĂ UE

Manuscrisele rămân pe infrastructură UE

Pro+ pe api.eu.noplag.com. Găzduit pe data centere Hetzner localizate UE (Falkenstein + Helsinki). Submisia, store-ul de amprente și raportul nu ies din spațiul UE. GDPR implicit; DPA la cerere.

Utilă pentru colaborări UE care cer Horizon Europe.
02 · AUTO-GĂZDUIRE

Rulează motorul la instituția dvs

Apache 2.0 + Docker compose. Fluxul complet rulează doar pe infrastructura dvs. Aduceți propriul Postgres + Redis; corpusul apare ca bundle indexabil în Enterprise. Nicio dată nu iese din VPC. Corect pentru date clinice, studii pacienți sau cercetare sensibilă.

Se integrează curat cu clustere Slurm și autentificare instituțională (SAML, LDAP, OIDC).
03 · DREPTUL LA ȘTERGERE

Ștergeți fiecare amprentă pe care o deținem pentru contul dvs

Un click în Setări. În 24h, orice amprentă, raport, allowlist sau metadată asociată contului este ștearsă. Conform GDPR Articolul 17. Utilizatorii self-host au acces direct la bază; cloud — au endpoint de ștergere documentat.

Jurnal de ștergere auditat păstrat pentru verificări de conformitate.
AUDITABIL IRB

Un motor Apache 2.0 pe care IRB-ul chiar îl poate analiza concret.

Recenziile instituționale pe softuri de detectat plagiat stagnează pe aceleași întrebări: unde ajunge manuscrisul după predare, cum funcționează algoritmul, dacă date sensibile/pacient ies, cum se realizează ștergerea efectivă, și dacă scorurile de acuratețe pot fi reproduse. La vendorii închiși, întrebările primesc răspuns doar în contact de vânzare. Apache 2.0 permite IRB-ului să cloneze repo-ul, să ruleze motorul pe sandbox, să auditeze fluxul de date, să testeze cap-coadă ștergerea, și să verifice F1 publicat pe corpus propriu. Nu promitem review mai ieftin — ci unul ce se poate chiar finaliza. De asta office-urile de date care refuzau alți furnizori aprobă acest motor.

Citiți ghidul de audit IRB
ÎNTREBĂRI IRB, RĂSPUNSURI
Q1Unde ajunge manuscrisul? — Postgres izolat per organizație pe endpoint UE; textul sursă șters după 30 zile dacă nu activați retenția.
Q2Se antrenează pe manuscrisele predate? — Nu. Manuscrisele nu intră în seturile de date de antrenare. Explicit în DPA.
Q3Gestionare date sensibile/pacienți? — Self-host motorul complet în rețeaua dvs. Datele nu ies din VPC. Se poate conforma HIPAA.
Q4Revizuire algoritm? — Apache 2.0 la github.com/NoplagLabs/noplag-engine. Cod lizibil, auditabil, reproductibil.
Q5Acces multi-instituțional? — Acces pe rol per organizație. Loguri audit pentru fiecare citire. Sau self-host pentru a nu ieși datele din rețea.
Q6Drept la ștergere? — Un click în Setări. Finalizare în 24h. GDPR Art. 17 conform. Log audit păstrat.
FAQ

Întrebările puse real de office-ul de cercetare.

De ce îmi schimbă scorul lista ORCID + DOI?
Pentru că motorul reclasifică orice fragment care se potrivește cu allowlistul ca SELF-CITE, nu UNCITED-PARA. Potrivirile nu dispar — doar marcate diferit. SELF-CITE aproape nu contează la scorul principal. Matematic: dacă citez de 2x pre-print personal și 1x lucrare anterioară coautor — acestea 3 trec din “numărate” la “reciclare academică legitimă”.
Se antrenează motorul pe manuscrisele încărcate?
Nu. Textul încărcat e fingerprintat (doar hashes, ireversibil) și stocat în baza izolată a utilizatorului. Textul se șterge după 30 zile daca nu activați retenția. Detectorul AI Binoculars care urmează se antrenează doar pe corpusuri publice; nu adăugăm încărcările clienților la antrenare. Explicit în DPA.
Ce se întâmplă cu pre-print-ul meu din arXiv / bioRxiv?
Dacă includeți DOI-ul pre-printului pe allowlist, potrivirile se marchează PREPRINT-SELF și nu contează la scor. Motorul recunoaște evoluția pre-print → publicare. Jurnalele ce interzic explicit pre-printuri pot folosi allowlist mai strict — dar majoritatea (Nature, Cell, NEJM, PLOS) acceptă, iar SELF tagging se aliniază.
Cum tratează detectorul AI co-autorii ESL?
Detecția AI va fi disponibilă în curând — pe roadmap-ul v1.2. La lansare, folosește calibrare pe fiecare limbă și verdict ajustat pentru ESL. Dacă semnătura lexicală indică engleză non-nativă (frecvent în colaborări internaționale), verdictul va fi ESL ADJ cu eroarea reziduală documentată, nu o afirmație de zero. Articolul Liang et al. 2023 a raportat 61,3% FPR pe eseuri TOEFL pentru detectorii naivi; publicăm metodologia de reducere a riscului la /docs/developers/benchmarks. Coautorii ESL nu sunt marcați incorect.
Pot rula motorul pe cluster Slurm pentru batch?
Da — Apache 2.0 + Docker. Rulează containerul engine pe nodurile de calcul ale clusterului; preia date din filesystem-ul partajat; generează rapoarte JSON acolo unde pipeline-ul tău citește. Util pentru verificarea în lot a rezultatelor unui an de laborator față de ultimul snapshot de corpus. Exemplu de script Slurm sbatch la github.com/NoplagLabs/noplag-engine.
Ce fac cu date clinice / manuscrise pacienți?
Self-host pe VPC. Datele nu ies din rețea. Motorul nu cere internet pentru corpusul indexat (pierderea stratului live-web, dar nu obligatoriu). Compatibil HIPAA cu setup-ul corect; IT-ul dvs îl administrează ca orice serviciu intern.
Cu ce diferă aici față de iThenticate la predare?
iThenticate rulează la predare și vede editorul — nu puteți itera. Noplag e auto-verificarea înainte de predare. Cascada acoperă conținutul open-access (de fapt mai larg post-Plan-S); mai îngustă pe conținut academic licențiat/subscriptie unde iThenticate are acord. Manevrarea auto-citării e cheia — iThenticate nu o face bine.
Se integrează cu managerul de referințe (Zotero / Mendeley / EndNote)?
Allowlist-ul preia BibTeX, RIS, API ORCID direct. Exportați biblioteca din Zotero sau introduceți ORCID; allowlist-ul se populează cu DOIs în câteva secunde. Sync în timp real cu Mendeley + EndNote e pe roadmap-ul v1.2; pentru acum doar export.
Cum stă cu acoperirea multilingvă pentru reviste non-engleză?
Detecția este calibrată pentru engleză, spaniolă, portugheză, poloneză și ucraineană la lansare, cu alte limbi în curs de adăugare. Cea mai bună acuratețe pe limbile europene (istoric lung de calibrare). Calitatea detecției este evaluată pe PAN-PC-11; evaluarea pe fiecare limbă este pe roadmap. Util în special pentru mediile academice europene și sud-americane.
Ce se întâmplă dacă un articol citat e retras după predare?
Crossref Retraction Watch marchează pe fiecare re-verificare a manuscrisului. Dacă ați predat deja, anunțați editorul (unele jurnale cer gestionarea explicită a retragerii după predare). Scorul nu se modifică, dar știți înainte de reviewer 2.

Rulați un capitol prin cascadă. Vedeți clasificarea auto-citării.

Încărcați schița unui manuscris, capitol de teză sau review grant. Adăugați ORCID. Vedeți ce fragmente sunt SELF-CITE, CITED, UNCITED-PARA, și (în curând) AI-LIKELY. Gratuit până la 2.500 de cuvinte. Rezidență UE pe Pro+ pentru materiale sensibile.

Verificare plagiat pentru cercetători pre-susținere