ONDERZOEKPre-submissie · Self-citatie bewust · EU-residentie · IRB-reviewbaar

Plagiaat checker voor onderzoekers pre-submissie

Pre-submissie controle van manuscripten op 700M+ wetenschappelijke werken. Mijn Mappen volgt uw eigen eerdere publicaties zodat legitieme self-citatie de score niet verhoogt. EU-residentie endpoint beschikbaar voor gevoelige pre-publicatie onderzoeken. Apache 2.0 engine — IRB-reviewbaar.

700M+ wetenschappelijke werkenSelf-citatie toestemmingslijstEU-residentie · IRB-reviewbaar
WAAR U OOK ZIT IN HET PROCES

Vier onderzoeksrollen. Eén self-check workflow.

PHD / DOCTORAAT

Dissertatiehoofdstuk pre-submissie

Itereren over hoofdstukken. Volg self-citatie door de versies heen.

  • Per-hoofdstuk check + versiegeschiedenis
  • Self-citatie toestemmingslijst (uw ORCID + DOI-lijst)
  • Bibliografie automatisch uitgesloten
POSTDOC

Manuscript vóór tijdschriftsubmissie

iThenticate controleert bij submissie; wij vooraf.

  • 700M+ open-access wetenschappelijke index
  • Citaties classificeren (geciteerde vs niet-geciteerde parafrase)
  • Vast tarief Pro · geen per-check kosten
AANVRAGER / GRANT WRITER

Literatuurstudie + voorstelcontrole

Eigen boilerplate uit eerdere aanvragen hergebruiken is normaal — merk het wel op.

  • Herken uw eigen eerdere publicaties + subsidies
  • Co-auteur toestemmingslijst (werk van collega’s)
  • Classificatierapport exporteren naar PDF voor collega’s
LAB PI

Lab-brede pre-publicatie QA

Vang issues bij alle lab-submissies in één queue.

  • Map per project + per postdoc
  • EU-residentie voor klinische / gevoelige primaire data
  • Apache 2.0 engine — te verdedigen bij IRB
PRE-SUBMISSIE WORKFLOW

Drie stappen vóór het manuscript het tijdschriftenportaal bereikt.

Draai iteratief. Markeer self-citaties zodat ze uw iThenticate / Crossref-score bij submissie niet verhogen. AI-detectie resultaten komen binnenkort, zodat u die kunt zien vóór reviewer 2 het aandraagt.

01

01 · Draft + toestemmingslijst

Upload het hoofdstuk / manuscriptconcept. Voeg uw ORCID + een lijst van uw DOIs (de toestemmingslijst) toe — uw eigen eerdere publicaties worden gelabeld als SELF-CITE, niet gemarkeerd als plagiaat. Co-auteur DOIs mee als u samenwerkte; de engine herkent legitiem academisch hergebruik.

02

02 · Draai de cascade

L1-winnowing → live-web nu, met L2 MinHash (v1.1) en L3 vector-embeddings (v1.2) later. Detecteert letterlijke en bijna-letterlijke overname; dekking van parafrases volgt met L2 en L3. Citaties worden geclassificeerd, zodat geciteerd materiaal wordt onderscheiden van ongeciteerde parafrases. Meertalig, met detectie gekalibreerd voor Engels, Spaans, Portugees, Pools en Oekraïens bij lancering; meer talen volgen. Mediaan 47 seconden per manuscript.

03

03 · Bekijk + herhaal

Het rapport markeert intervallen per categorie: SELF-CITE (uw eigen, verwacht), CITED (geciteerd, verwacht), CITED-PARA (geparafraseerd met citaat, lage waarde), UNCITED-PARA (deze verdient aandacht), en AI-LIKELY (met een ESL-gecorrigeerde marge) binnenkort beschikbaar. Reproduceerbaar — engine commit + corpus snapshot op elk rapport.

SELF-CITATIE AFHANDELING

Zes vormen van legaal academisch hergebruik — geen enkele mag uw score verhogen.

Black-box checkers markeren elke tekstmatch als plagiaat. Onderzoekers hergebruiken tekst legitiem. Zo classificeert onze engine.

01 · EIGEN EERDERE WERK

ORCID + DOI toestemmingslijst. Uw eerder gepubliceerde artikelen worden bij overeenkomst gelabeld als SELF-CITE — niet gemarkeerd als plagiaat. Komt vaak voor in literatuurstudies ('zoals ik stelde in Chen 2023…') en subsidievoorstellen waarbij u voortbouwt op eerder werk.

02 · GECOAUTEURD WERK

Voeg ORCIDs van co-auteurs toe aan de toestemmingslijst. Co-auteursartikelen krijgen het label CO-CITE. Handig voor manuscripten die voortbouwen op gezamenlijk werk — standaard methodesecties worden legitiem gedeeld.

03 · LABORATORIUMERFGOED

PI-map gedeeld corpus: standaard methodes, labprotocollen, ethiekteksten die terugkeren in labpublicaties. Gelabeld als LAB-CITE en uitgesloten van de score. IRB-goedgekeurde boilerplate hoeft niet steeds opnieuw te worden geschreven.

04 · EMBARGO PREPRINTS

Uw eigen arXiv / bioRxiv preprint van het manuscript dat u nu indient. De engine herkent evolutie van preprint naar journal-versie en labelt als PREPRINT-SELF. Tel niet mee voor de score. Voor tijdschriften die preprints actief uitsluiten is striktere configuratie mogelijk.

05 · INGETROKKEN CITATIES

Crossref Retraction Watch-integratie markeert overeenkomsten met ingetrokken artikelen. Heeft geen invloed op uw gelijkenisscore — maar u wilt het vooraf weten. Vangt het 'ik citeerde een artikel dat vorige maand is ingetrokken'-probleem voordat reviewer 2 het doet.

06 · IRB / GEVOELIG

EU-residentie endpoint (api.eu.noplag.com) houdt het manuscript in de EU-infrastructuur. Volledig engine self-hosten binnen uw netwerk voor HIPAA / GDPR / patiëntgegevens. Apache 2.0 + Docker; geen verkeer verlaat uw VPC.

MIJN MAPPEN · LAB VIEW

Georganiseerd per project. Audittrail op datum.

Groepeer manuscripten per project, labjaar of subsidieronde. Draai versies later opnieuw tegen dezelfde engine commit — rapporten blijven maandenlang reproduceerbaar.

MIJN MAPPEN · Dr. Hirano lab · CompBio24 manuscripten · 6 projecten
EU-RESIDENTIENieuwe map
MAPDOCSLAATSTE ACTIVITEITREGIO
Project: PD-L1 expressiecohort8 manuscriptenconcept v3 gecheckt · 2 uur geledenEU
Project: synthetic-bio veiligheidsreview5 manuscriptenindienklaar · gisterenEU
Subsidie: NIH R01 verlenging Y33 manuscriptenliteratuurstudie v2 gecheckt · 2 dagen geledenEU
Lab-erfgoed: methodes + ethiektekst4 docs · gedeeldlab-toestemmingslijst bijgewerkt · 1 week geledenEU
Preprints: arXiv in verwerking2 manuscriptenPREPRINT-SELF gemarkeerd · 1 week geledenEU
Gearchiveerd (2022–2024)12 artikelenself-citatiesetEU
Alle mappen EU-residentie · versleuteld opgeslagen · IRB-reviewbare engine commit bij elk rapportreproduceerbaarheid: engine v0.4.2 actief
700M+geïndexeerde wetenschappelijke werken
5detectietalen bij start, uitbreiding volgt
EUresidentie endpoint beschikbaar
Apache2.0 · IRB-reviewbaar
Crossref+ Retraction Watch-integratie
DATAPROTECTIE

Drie eisen voor gevoelige pre-publicatie research aan een checker.

01 · EU-RESIDENTIE

Manuscripten blijven altijd op EU-infrastructuur

Pro+ op api.eu.noplag.com. Gehost op EU-gebaseerde Hetzner datacenters (Falkenstein + Helsinki). De submissie, vingerafdrukken en rapporten blijven binnen de EU. Standaard GDPR-compliant; DPA op aanvraag.

Handig voor samenwerkingen met EU-partners onder Horizon Europe regels voor gegevensbescherming.
02 · SELF-HOST

Draai de engine binnen uw eigen instelling

Apache 2.0 + Docker compose. De volledige detectie draait volledig op uw eigen infrastructuur. Gebruik uw eigen Postgres + Redis; wij leveren de corpus als indexeerbare bundle voor Enterprise. Geen verkeer verlaat uw VPC. Geschikt voor klinische-trialdata, patiëntcases of commercieel gevoelige primaire research.

Werkt samen met Slurm-clusters en bestaande institutionele authenticatie (SAML, LDAP, OIDC).
03 · RECHT-OP-VERWIJDERING

Verwijder elk vingerafdruk die wij bewaren voor u

Eén klik in Instellingen. Binnen 24 uur worden alle vingerafdrukken, rapporten, toestemmingslijsten en metadatavelden die wij van uw account bewaren verwijderd. Voldoet aan GDPR Artikel 17. Zelf-host gebruikers hebben directe database-toegang; cloudgebruikers vinden de verwijder-API endpoint in de documentatie.

Verwijderingslogboek bewaard voor compliance-audits.
IRB-REVIEWBAAR

Een Apache 2.0 engine die uw IRB daadwerkelijk kan reviewen vóór goedkeuring.

De meeste institutionele researchsoftware-kritieken op plagiaattools blijven hangen op dezelfde vragen: waar gaat het manuscript na submissie, wat doet het matching-algoritme, wordt patiënt-/gevoelige data ooit verzonden, hoe werkt het recht-op-verwijdering, en is de gepubliceerde nauwkeurigheid reproduceerbaar. Bij geslotensource-leveranciers krijgt u pas antwoorden tijdens verkoopgesprekken. Bij Apache 2.0 kan uw IRB de repo klonen, de engine op een sandbox draaien, datastromen inspecteren, eind-tot-eind recht-op-verwijdering verifiëren en gepubliceerde F1 scores per taal reproduceren op hun eigen testset. Wij beweren niet dat de review goedkoper is — maar wél dat uw IRB hem gewoon kan afronden. Daardoor ondertekenen data-offices die eerder alle plagiaattools weigerden deze wel.

Lees de IRB-reviewgids
IRB VRAGEN, BEANTWOORD
Q1Waar gaat het manuscript heen? — Tenant-geïsoleerde EU Postgres als u via de EU-residentie endpoint werkt. Brontest na 30 dagen verwijderd tenzij retentie is ingeschakeld.
Q2Trainen op ingediende manuscripten? — Nee. Ingestuurde manuscripten worden nooit gebruikt om detectiemodellen te trainen. Expliciet in de DPA.
Q3Patiënt-/gevoelige data? — Draai de engine volledig binnen uw netwerk. Geen verkeer verlaat uw VPC. HIPAA-compatibele uitrol.
Q4Algoritme inzien? — Apache 2.0 op github.com/NoplagLabs/noplag-engine. Leesbaar, controleerbaar, reproduceerbaar.
Q5Toegang tussen instellingen? — Rolgebaseerde toegang per tenant. Auditlogs voor elke raadpleging. Of self-host, zodat de data nooit uw eigen instelling verlaat.
Q6Recht-op-verwijdering? — Eén klik in Instellingen. Binnen 24 uur. Voldoet aan GDPR Art. 17. Auditlog bewaard.
FAQ

De vragen die een onderzoeksbureau echt stelt.

Waarom verandert mijn gelijkenisscore als ik mijn ORCID + DOI-lijst toevoeg?
Omdat de engine alle overlappende stukken die overeenkomen met een paper op uw toestemmingslijst als SELF-CITE classificeert in plaats van UNCITED-PARA. De overeenkomsten verdwijnen niet — ze krijgen alleen een ander label. SELF-CITE-intervallen tellen vrijwel niet in het hoofdscore. De wiskunde: als uw dissertatiehoofdstuk tweemaal naar een eigen preprint verwijst en eenmaal naar een co-auteur, gaan die drie intervallen van ‘meegerekend’ naar ‘verwacht academisch hergebruik’.
Trainen jullie engine op ingediende manuscripten?
Nee. Ingestuurd tekst wordt alleen gehashed (winnowing-hashes — een niet-omkeerbare handtekening) en opgeslagen in uw tenant-geïsoleerde database. De tekst zelf wordt na 30 dagen verwijderd tenzij retentie is ingeschakeld. De Binoculars-AI detector (binnenkort) wordt getraind op publieke data; wij voegen klantmanuscripten niet toe aan de trainingset. Staat expliciet in de DPA.
Wat gebeurt er met mijn preprint op arXiv/bioRxiv?
Als u het DOI van de preprint op uw toestemmingslijst zet, krijgt overeenkomende tekst het label PREPRINT-SELF en telt niet mee voor de uiteindelijke score. De engine weet dat de overgang preprint → journal verwacht is. Tijdschriften die preprints uitsluiten (sommigen doen dat) kunnen een strengere toestemmingslijst instellen — maar de meeste grote tijdschriften (Nature, Cell, NEJM, PLOS) accepteren preprints; SELF-tagging is volgens hun beleid.
Hoe gaat de AI-detector om met niet-native Engelse co-auteurs?
AI-detectie volgt binnenkort — staat op de v1.2-roadmap. Bij introductie wordt per taal gekalibreerd, met een uitspraak aangepast voor niet-moedertaalsprekers (ESL). Als het lexicale profiel wijst op niet-native Engels (vaak bij internationale samenwerking), wordt het oordeel als ESL ADJ gegeven met een vastgelegde restfout, niet als nul. Liang et al. 2023 vond 61,3% FPR op TOEFL-essays bij naïeve detectors; onze mitigatie staat op /docs/developers/benchmarks. Co-auteurs met een andere moedertaal worden niet onterecht gemarkeerd.
Kan ik de engine op een Slurm-cluster draaien voor batchchecks?
Ja — Apache 2.0 + Docker. Draai de engine-container op de compute-nodes van je cluster; voer in vanaf je gedeelde bestandssysteem; exporteer rapporten als JSON naar de plek waar je pipeline ze ophaalt. Geschikt om bijvoorbeeld een jaar aan laboutput in batch te controleren tegen de nieuwste corpus-snapshot. Voorbeeld van een Slurm sbatch-script op github.com/NoplagLabs/noplag-engine.
Hoe zit het met manuscripten met patiëntgegevens?
Self-host binnen uw VPC. Geen verkeer verlaat uw netwerk. De engine heeft geen internet nodig voor corpus-gebaseerde checks (live-web verificatie werkt dan niet, maar dat is optioneel). HIPAA-compatibele installatie als uw IT dat goed inricht; behandelen als elke interne service.
Hoe verschilt dit met iThenticate bij submissie?
iThenticate wordt uitgevoerd bij submissie en is zichtbaar voor uw editor — u kunt dus niet meer itereren. Noplag is uw self-check vóór submissie. De cascade is vergelijkbaar op open-access content (zelfs breder sinds Plan-S); smaller op betaalde content waar iThenticate licenties voor heeft. Self-citatie is wat onderzoekers meestal echt nodig hebben maar waar iThenticate niet goed mee omgaat.
Integreert dit met mijn referentiemanager (Zotero / Mendeley / EndNote)?
Toestemmingslijst import ondersteunt BibTeX, RIS en ORCID API. Drop uw Zotero-export of plak uw ORCID; alle DOIs worden binnen seconden ingeladen. Realtime sync met Mendeley + EndNote staat op de v1.2 roadmap; voor nu is het exporteren.
Hoe zit het met niet-Engelstalige publicatie in onderzoekstijdschriften?
Detectie is gekalibreerd voor Engels, Spaans, Portugees, Pools en Oekraïens bij lancering; meer talen volgen. Het sterkst op Europese talen (lange kalibratiegeschiedenis). Detectiekwaliteit is gebenchmarkt op PAN-PC-11; evaluatie per taal staat op de roadmap. Vooral bruikbaar in Europese en Zuid-Amerikaanse academische contexten.
Wat als een geciteerd artikel wordt ingetrokken na mijn submissie?
De Crossref Retraction Watch-integratie markeert het bij elke nieuwe check. Als u al hebt ingediend, vraagt de editor notificatie (sommige tijdschriften vereisen expliciet beleid bij intrekking post-submissie). Verandert de gelijkenisscore niet, maar u wordt op tijd gewaarschuwd.

Draai een hoofdstuk door de cascade. Zie de self-citatie uitsplitsing.

Drop een manuscriptconcept, een dissertatiehoofdstuk of een subsidie-literatuurstudie. Voeg uw ORCID toe. Zie welke intervallen SELF-CITE, CITED en UNCITED-PARA zijn, met AI-LIKELY binnenkort beschikbaar. Gratis tot 2.500 woorden. EU-residentie op Pro+ voor gevoelige pre-publicatie.

Plagiaat checker voor onderzoekers pre-submissie