Academische plagiaat checker voor wetenschappelijke teksten
Plagiaatdetectie voor wetenschappelijk schrijven — controleert tegen 700M+ wetenschappelijke werken via OpenAlex, CORE, arXiv, PubMed Central en Crossref. Herkenning van citaties. Apache 2.0-engine, controleerbaar door elke IT-afdeling.
Vijf bronnen. 700M+ werken. Alles open-access of DOI-geregistreerd.
Geen betaalmuur-content — wij werken alleen met open-access indexen. Ruimere dekking voor post-Plan-S onderzoek; beperkter voor oude betaalde tijdschriften.
OpenAlex
250M+ werkenOpen wetenschappelijke index — vervangt de oude Microsoft Academic Graph. Dekking van artikelen, conferentiepapers, datasets, boeken uit alle vakgebieden.
CORE
290M+ papersWereldwijd grootste open-access onderzoeksaggregator. Volledige tekst uit 11.000+ repositories geïndexeerd. Sterk op Europees + UK onderzoek.
arXiv
2,4M+ preprintsNatuurkunde, wiskunde, informatica, kwantitatieve biologie, statistiek, economie. Vergelijkt met precies de versie die uw beoordelaar op arXiv ziet.
PubMed Central
10M+ papersOpen biomedisch / life sciences-archief. Volledige tekst + metadata geïndexeerd. NIH-onderzoek en journaalfeeds.
Drie workflows. Eén product.
Of u nu een artikel voorbereidt, een dissertatiehoofdstuk verdedigt of een subsidieaanvraag afrondt — deze checker past zich aan de situatie aan, niet andersom.
01 · Pre-submissie tijdschrift-check
Laat het manuscript controleren in het open-access universum vóórdat uw tijdschrift dit doet. iThenticate / Crossref Similarity Check wordt bij inzending toch gedaan — u wilt zelf zien wat de redacteur straks ziet. Flat-rate Pro betekent herhaald checken per concept zonder aparte kosten per versie.
02 · Dissertatie- of thesishoofdstuk
Per hoofdstuk of hele scriptie tegelijk. Zelf-citatie tussen hoofdstukken wordt gemarkeerd maar apart geclassificeerd (toegestaan bij scriptielengte). Bibliografie wordt automatisch uitgesloten. Versiebeheer vergelijkt bijvoorbeeld januari met mei — u ziet wat is aangepast, opgeschoond of nieuw toegevoegd.
03 · Subsidieaanvraag of literatuuroverzicht
Standaardteksten uit eerdere subsidieaanvragen die u zelf schreef mogen niet als plagiaat tellen. Correct geciteerd literatuuroverzicht ook niet. Het classificatiemodel behandelt geldig hergebruik (eigen werk met citatie) anders dan per ongeluk overnemen. De score drukt alleen uit wat echt problematisch is.
Zes categorieën. Elke match valt ergens onder.
Een gelijkenisrapport van 28% op een sterk geciteerd overzichtsartikel zegt iets anders dan 28% bij ongeciteerd parafraseren. Classificatie maakt dat verschil.
01 · Direct citaat (geciteerd)
Aanhalingstekens + bronvermelding of voetnoot. Telt zoals verwacht; niet meegeteld voor gelijkenisscore. Meerdere citaatstijlen automatisch herkend (MLA / APA / Chicago / Harvard / Vancouver / IEEE).
02 · Blokcitaat
Ingesprongen passage van 40+ woorden met bronvermelding aan het eind. Telt zoals verwacht. Indentatiepatroon van 1,25 cm + citaat wordt herkend; zonder inspringen volgt een format-waarschuwing.
03 · Parafrase (geciteerd)
Match qua zinsopbouw met bronvermelding ergens in de alinea. Telt met minder gewicht. Ook formuleringen als “Smith (2023) geeft aan...” gelden als correcte verwijzing.
04 · Algemeen bekend
Zinnen die in 2.000+ onafhankelijke bronnen voorkomen (“Water kookt bij 100°C”, standaarddefinities, bekende formules). Niet meegerekend. Drempel aanpasbaar per vakgebied.
05 · Bibliografie
Referentielijst automatisch herkend aan kop + opmaak. Helemaal uitgesloten van gelijkenisscore. Bronnen zelf hoeven niet origineel te zijn — ze mee laten tellen vertekent de score.
06 · Niet-toegeschreven parafrase
Match qua zinstructuur zonder bronvermelding, zonder aanhalingstekens en zonder blokopmaak. Dit is de categorie die uw gelijkenisscore bepaalt. Telt volledig mee; andere matches niet.
Per-match classificatie. Per-bron URL. Volledig controleerbaar.
Elke match bevat de bron-DOI / URL, het classificatietype, timestamp van de corpus-snapshot en de engine-commit. Geschikt voor peer review, integriteitsoverleg of IT-audit.
Modernisme is minder een samenhangende beweging dan een verzameling van afwijzingen — van realisme, vooruitgang, het eenvormige zelf... (Eysteinsson, 1990, p.117).
doi.org/10.7551/mitpress/4596.001.0001 · MIT Press, 1990Eliots nadruk op onpersoonlijkheid plaatst de lyriek als geconstrueerd object, niet als uitbarsting van gevoel.
Eliot, T.S. (1919). Tradition and the Individual Talent · Egoist Press · doi.org/10.2307/24…De roman komt voort uit een fundamenteel burgerlijk wereldbeeld dat in de achttiende eeuw ontstond.
openalex.org/W12345678 · Watt (1957) — ongeciteerde matchJoyces stream of consciousness dankt veel aan William James' psychologie van innerlijke duur.
James, W. (1890). The Principles of Psychology, hfst.IX (genoemd in referentielijst)Eerder gepubliceerde dissertatie van de auteur, Hoofdstuk 1.
ucl-discovery.com/dissertation/2024-Modernism-Chen.pdf · zelf-citatie, geen bron in deze alineaAlle referenties — Eysteinsson, Eliot, Joyce, James, Watt, en 32 anderen.
Bibliografie, p. 38–41- 700M+wetenschappelijke werken geïndexeerd
- 6citaties automatisch herkend
- 5talen gekalibreerd bij lancering
- 3%ESL-vooroordeel restfout (gedocumenteerd)
- Apache2.0 · IRB-reviewbaar
Drie dingen overleeft een black-box checker niet in een hoorzitting.
Zelfde paper opnieuw, zelfde commit
Elk rapport toont X-Engine-Commit en een snapshot-datum. Maanden later kunt u hetzelfde manuscript opnieuw controleren tegen precies dezelfde engine-versie — zelfde input, algoritme, resultaat. Gesloten bron-checkers kunnen (stilletjes) aanpassen en dan wijkt januari van mei af.
Apache 2.0-bron op GitHub — neem mee naar het overleg
Als AI-detectie wordt uitgerold (binnenkort, v1.2), en een student disputeert het AI-oordeel, kunt u precies commit en code aanwijzen die tot het besluit leidde, plus de ESL-documentatie tonen. Geen screenshot van een vendor-reply.
Gedocumenteerd door Liang et al. 2023; mitigatie staat op de roadmap
Stanford 2023 rapporteerde 61,3% FPR op TOEFL-essays bij naïeve detectors. Wanneer AI-detectie van Noplag wordt uitgerold (binnenkort, v1.2 roadmap), krijgt het oordeel een ESL-gecorrigeerde band als het lexicale profiel op niet-moedertaal Engels wijst. Restfouten worden gedocumenteerd, niet als nul gepresenteerd. Override wordt gelogd met engine-commit en reden.
Een Apache 2.0-engine die uw IT-revisie doorstaat.
Dezelfde vragen voeren de boventoon bij academische software-inkoop: waar gaat het document na upload, wat doet het algoritme, wie heeft toegang, hoe werkt wissing, en klopt de nauwkeurigheid? Bij een gesloten vendor beantwoordt sales dat. Bij Apache 2.0 kan IT de repo klonen, engine lokaal draaien, datastromen auditen, wissing controleren en F1-scores testen op eigen corpus. Geen goedkopere revisie — wél één die uw IT echt kan afronden. Dat is waarom sommige universiteiten, die nooit andere vendors wilden goedkeuren, deze wél tekenen.
Lees de inkoopgidsDe vragen die academici echt stellen.
Vervangt dit iThenticate voor auteurs vóór inzending?
Meestal niet — als uw tijdschrift iThenticate verplicht stelt (Elsevier, Springer, Wiley, IEEE), gebeurt dat bij inzending alsnog. Noplag is er juist voor checks voorafgaande aan inzending, bij meerdere versies. iThenticate à $125 per document loopt snel op; flat-rate Pro niet. Zie de volledige vergelijking op noplag.com/vs-ithenticate.
En ProQuest-dissertaties? Hebben jullie die niet?
Klopt — dat gat bestaat. ProQuest's database is betaald en staat niet in OpenAlex/CORE. Wij dekken de ~700M open-access werken, wat breder is voor Plan S-onderzoek (vanaf 2018); smaller voor oudere, betaalde dissertaties. Bijna alleen Amerikaanse PhD's nodig? iThenticate is daar beter in.
En andere citatiestijlen dan de grote zes?
MLA, APA, Chicago/Turabian, Harvard, Vancouver, IEEE worden automatisch herkend. Minder gangbare stijlen (ACS, AMA, ASA, Bluebook, Oxford) krijgen basisdetectie via aanhalingstekens + patronen in de buurt, tot fine-tune volgt op v1.2 roadmap. Zelf-hosters kunnen eigen stijlen toevoegen in alignment/-module.
Hoe vaak vals-positief bij sterk geciteerde overzichten?
Minder dan reviewers zonder deze classificatie verwachten, omdat correct geciteerde stukken buiten de hoofdscore vallen. Gemiddeld ~3,4% vals-positief op PAN-PC-11 subset (veel legitiem citaat). Concurrenten zonder classificatie rapporteren 12–18% op hetzelfde corpus.
Kan ik eigen publicaties uitsluiten?
Pro-niveau — voeg een zelfcitatie-allowlist toe (uw ORCID, vorige DOIs, uw instelling-URL). Matches hiermee krijgen ZELFCITAAT-label en tellen niet mee. Handig voor aanvragen op eigen werk; zelfhergebruik + citaat hoort erbij.
Hoe goed werkt detectie meertalig?
Detectie is bij lancering gekalibreerd voor Engels, Spaans, Portugees, Pools en Oekraïens. Meer talen volgen. Detectiekwaliteit wordt gebenchmarkt op PAN-PC-11; evaluatie per taal staat op de roadmap. Het sterkst op Europese talen met de langste validatiegeschiedenis; nieuwere talen worden toegevoegd zodra hun kalibratie voldoende is.
Wat betekent “Apache 2.0” voor inkoop?
Uw IT / FG / METC kan github.com/NoplagLabs/noplag-engine clonen, de engine in een sandbox draaien, de datastroom auditen, verifiëren dat het recht op verwijdering end-to-end werkt, en onze gepubliceerde benchmarkresultaten reproduceren op een eigen testcorpus. Zonder iets te ondertekenen, zonder NDA, zonder op onze marketing te vertrouwen. Voor instellingen waar het inkoopproces deze mate van controle vereist, is dit de oplossing.
Gaat AI-detectie ook Claude-3 + Gemini herkennen, of alleen GPT?
AI-detectie volgt binnenkort — staat op de v1.2-roadmap, niet beschikbaar bij lancering. De aanpak is Binoculars (Hans et al. 2024), model-agnostisch: er wordt niet per LLM getraind, maar de perplexiteit van een klein referentiemodel wordt vergeleken met de testtekst, wat generaliseert. Nauwkeurigheidscijfers worden gepubliceerd zodra de feature de evaluatie doorstaat, niet vooraf, op gemixte LLM-content (vs ~70% op Claude-3 voor GPT-getrainde detectors). De methodologie beschrijft de faalmodi; die worden niet verborgen.
Wat als mijn begeleider een vlag betwist?
Elke flagged match toont DOI, snapshot, commit en classificatie-reden. Herhaal de check met die commit; resultaat reproduceert precies. Print het rapport voor in het overleg, citatiepaden zijn klikbaar. Er is geen 'geloof ons'-modus — dat hebben alleen black-box checkers.
En self-host voor medisch/klinisch onderzoek, ivm HIPAA?
Apache 2.0 + Docker — draait 100% op eigen netwerk. Combineer met PostgreSQL + Redis op eigen infra; geen enkele data gaat buiten de VPC. Handig voor klinische manuscripten, casussen, of pre-publicatieonderzoek dat niet naar de cloud mag. Enterprise krijgt het corpus als bundle.
Controleer een hoofdstuk tegen 700M+ wetenschappelijke werken.
Dien een dissertatiehoofdstuk, subsidieaanvraag of manuscriptversie in. Het citatiebewust rapport toont wat klopt, wat een bron mist, en wat van uzelf is. Gratis tot 2.500 woorden. Apache 2.0 als IT de code wil controleren.