Plagiaat checker voor uitgevers pre-publicatie en audit
Pre-publicatiecontroles voor freelancer-inzendingen, syndicatieaudits voor herpublicaties, en een REST API die uw technische team direct in uw CMS kan integreren. De detectie-engine is Apache 2.0 — leesbaar vóór gebruik, niet erna.
Vier redacties. Eén workflow.
Beoordeel een freelance pitch voor toewijzing
10 minuten per inzending, voordat het redactiebudget wordt ingezet.
- Plak een conceptpitch / fragment, zie eerder gepubliceerde versies
- AI-waarschijnlijkheid per alinea (binnenkort), ESL-herkenning
- Sla de discussie over ‘is dit origineel?’ over
Verwerk de daglijst voor de pers
Bulk-scan de artikelen van vandaag voor ze in de CMS-publicatie wachtrij komen.
- Wachtrijweergave gesorteerd op overeenkomst + AI-score
- Afkappunten per rubriek (op-ed vs nieuws vs recensie)
- Audit-trail per journalist voor de standards desk
Onderzoek een betwiste inzending
Lees het algoritme, daarna de gematchte intervallen.
- X-Engine-Commit reproduceerbaarheid
- Uitspraak overschrijven met beargumenteerde reden
- Apache 2.0 — verdedigbaar bij correctiepagina-review
Audit de partners die u herpubliceren
Volg gezondheid van canonical-tags over het syndicatienetwerk.
- Canonical-herkenning (ORIGIN / SYND OK / LEAK)
- Wekelijks diff-rapport per partner
- DMCA-grade bewijspakket op aanvraag
Drie stappen voor het artikel de CMS-publicatierij bereikt.
Ingebed in uw redactieworkflow via API, als bulkcontrole voor publicatie of eenmalig in het dashboard. Zelfde engine, zelfde rapportstructuur — past waar nodig.
01 · Intake
Inzending komt in uw CMS-rij — drag-drop de .docx / .gdoc / plak, of CMS pusht via webhook. Metadata van auteur + sectie + toegewezen redacteur gaat mee voor de auditlog.
02 · Scan + classificatie
De cascade draait tegen open web + Common Crawl + (optioneel) uw eigen archief. Bronnenclassificatie scheidt geciteerde quotes (met bronvermelding) van niet-vermelde parafrase. AI-waarschijnlijkheid per alinea volgt binnenkort, ESL-herkenning is inbegrepen. Mediaan 42s per artikel.
03 · Beslis + publiceer
Redacteur ziet: kop-overeenkomst, uitsplitsing naar categorie, sorteerlijst van bronnen (AI-score met ESL-markering volgt binnenkort). Drie acties: publiceren, terugsturen met feedback, doorzetten naar standards desk. Beslissing gelogd met engine commit + corpus snapshot.
Vier CMS-oppervlakken. Eén REST-contract.
Koppel Noplag aan het CMS dat uw journalisten al gebruiken. Het API-oppervlak is identiek — alleen de integratielaag verschilt (WordPress-hooks, Ghost-acties, Drupal-events of uw eigen webhooks).
Officiële plugin uit de WordPress.org Plugins Directory. Gutenberg-compatibel.
- Pre-publicatie metabox op elk posttype
- Highlight per blok in de editor
- Auditlog via WP REST API
Webhook-integratie + Admin API. Geschikt voor ledencontent.
- Pre-publicatie webhook bij save_draft
- Scanbeleid per tag en contenttype
- Zelf-hosting mogelijk (Noplag zelf-host + Ghost zelf-host)
Contrib-module van drupal.org. Field-API-attacher.
- Plagiaatveld per contenttype
- Workflow-integratie met Content Moderation
- Multi-siteconfig ondersteund
Webhooks + OpenAPI 3.0-specificatie. Voor headless CMS, eigen systemen of anders.
- POST /v1/checks vanuit elke CMS-hook
- HMAC-gesigneerde webhook-callbacks
- Python + Node SDKs op basis van de OpenAPI-spec
Wachtrij van vandaag. Sorteerbaar, audit-gelogd.
Per artikel een rij met journalist, rubriek, overeenkomst, AI-score en een klik naar het highlight-rapport. Sorteerbaar. Goedgekeurde artikelen bulk-publiceren; de rest escaleren.
Zie wie u herpubliceert — en of de canonical-tag naar u verwijst.
Volg uw distributienetwerk
Voeg de domeinen toe waar u aan syndiceert (Medium, LinkedIn, Substack, uw netwerkpartners) als allowlist. Wekelijks crawlen rapporteert terug welke partners rel=canonical naar u laten verwijzen (ORIGIN), waar het ontbreekt (SEO-lek), en waar zonder toestemming wordt gerepost (SCRAPED).
Op welke blog ontbreekt uw byline?
Open-webdiffs (maandelijks) detecteren niet-toegestane domeinen die intervallen van uw artikelen publiceren. De match wordt geleverd met een snapshot met tijdstempel — DMCA-grade bewijs gedateerd op de dag dat de kopie verscheen. Wij dienen geen DMCA’s in (dat is een juridische kwestie); u krijgt het papierwerk.
Interne duplicatie op uw eigen pagina’s
Pro scan op folderniveau: plaats uw gepubliceerde corpus in een map; de engine bouwt een overeenkomstenmatrix voor elk paar. Vindt bijvoorbeeld de 47 stadspagina’s met dezelfde boilerplate — risico op Helpful-Content-Update dat u vooraf wilt weten.
Drie beleidsregels waar uw standards desk om vraagt voor inkoop.
Ten eerste — ingediende artikelen worden nooit gebruikt om een model te trainen. Niet het onze, niet dat van anderen. Ingediende tekst wordt gefingerprint, geïndexeerd binnen uw tenant, en na 30 dagen verwijderd tenzij expliciet bewaard. Ten tweede — het AI-oordeel (binnenkort beschikbaar, staat op de roadmap) wordt per alinea gegeven, niet per artikel, en voorzien van het engine-commit en de timestamp van de corpus-snapshot. Een betwiste AI-markering zal maanden later opnieuw verschijnen bij hetzelfde commit. Geen stille hertraining. Ten derde — Apache 2.0 betekent dat uw technische team github.com/NoplagLabs/noplag-engine kan klonen, op eigen infrastructuur draaien, de datastroom kan auditen en het recht-op-vergetelheid-proces van begin tot eind kan verifiëren. De meeste inkooptrajecten voor plagiaatsoftware bij instellingen lopen vast op deze drie punten; wij proberen ze vooraf te beantwoorden.
Lees de handleiding voor redactiebeleidWat de standards desk écht vraagt voor inkoop.
- Worden onze artikelen gebruikt om het AI-model te trainen?
- Nee. Ingezonden artikelen worden alleen gevingerprint (winnowing hashes) en opgeslagen in een tenant-geïsoleerde database. De tekst zelf wordt na 30 dagen verwijderd tenzij u bewaring inschakelt. Het AI-detectiemodel — Binoculars-based (Hans et al. 2024), binnenkort — wordt vooraf getraind op publieke corpora; wij voegen daar nooit klantcontent aan toe. Staat expliciet in de DPA.
- Hoe blijft het AI-oordeel per alinea overeind bij discussie met een journalist?
- AI-detectie komt binnenkort — staat op de v1.2-roadmap, niet beschikbaar bij lancering. Zodra het beschikbaar is, krijgt elke gemarkeerde alinea een stempel met het engine-commit en de corpus-snapshot. Voer dezelfde alinea opnieuw uit tegen dat commit en het oordeel is identiek. De algoritmebron staat open op github.com/NoplagLabs/noplag-engine (Apache 2.0), met verwijzing naar de perplexity-drempel en documentatie van de ESL-gekalibreerde afstelling. Er is geen modus 'vertrouw het cijfer'.
- En freelancers die uploaden met trage verbinding?
- Detectie is bij lancering gekalibreerd voor Engels, Spaans, Portugees, Pools en Oekraïens. Meer talen volgen. Detectiekwaliteit wordt gebenchmarkt op PAN-PC-11; evaluatie per taal staat op de roadmap. AI-oordelen die zijn aangepast voor niet-moedertaalsprekers markeren non-native Engels als ESL ADJ in plaats van LIKELY-AI wanneer het lexicale profiel daar aanleiding toe geeft.
- Kunnen we zelf-host draaien binnen onze redactie?
- Ja — Apache 2.0 engine + Docker. Draait volledig binnen uw netwerk. Combineer met uw eigen Postgres + Redis; geen inzendverkeer verlaat uw VPC. Handig voor redacties met strikte bronbescherming of pre-publicatievertrouwelijkheid.
- Integreert dit met ons CMS?
- WordPress (officiële plugin), Ghost (Admin API + webhooks), Drupal (contrib module). Voor andere systemen — custom CMS, headless, eigen ontwikkeling — de REST + OpenAPI 3.0 spec biedt uw technisch team alles om een pre-publicatiehook in een dag te bouwen. Python en Node SDKs uit de spec.
- Wat doet de syndicatie-auditfunctie precies?
- Voeg uw distributiedomeinen toe aan een allowlist (medium.com/@u, partners). Wekelijks crawlrapport geeft canonical-gezondheid: ORIGIN (wijst naar u), SYND OK (partner wijst naar u), LEAK (canonical ontbreekt of wijst elders — SEO-deling), of SCRAPED (copy, geen canonical, niet op allowlist). Bij SCRAPED hoort een met tijdstempel gemarkeerde snapshot voor DMCA-bewijs.
- Hoe werkt prijsstelling voor een redactie van 30 journalisten?
- Premium voor $79/maand is 5.000 woorden/check, 5.000 artikelen/maand, volledige API + CMS-integratie. Voor hoge volumes (10.000+ artikelen/maand) is Enterprise prijs per corpus + infrastructuur. Geen per-journalist prijs — alleen volume schaalt.
- En voor opinie, syndicatie, boekfragmenten waarbij wat hergebruik normaal is?
- Afkappunten per rubriek op Pro+ — verschillende gevoeligheid voor nieuws, opinie, recensie, fragmenten. Een opiniestuk met een citaat uit Senaat hoeft niet hetzelfde drempel als nieuws te halen. Bronclassificatie scheidt legitiem citaat van onbedoeld hergebruik.
- Vertraagt dit onze publicatierij?
- Mediaan 47 seconden per 1.500–4.000 woorden. De CMS-hook is async — werk bij save_draft, redacteur ziet beoordeling als proeflezen klaar is. Lange features (8.000+ woorden) nemen ~90 seconden, te draaien als pre-publicatiejob.
- Kunnen wij ons archief toevoegen als eigen corpus?
- Ja — Enterprise-laag. Laad uw archief bulk als privé-corpus zodat nieuwe inzendingen hiertegen worden gecontroleerd. Spoort zelf-hergebruik door journalisten op (soms legitiem, soms niet) en hergebruik van ouder werk onder nieuwe byline.
Draai een concept door de wachtrij. Bekijk het artikelrapport.
Upload een Word- of Google Doc of een geëxporteerd CMS-artikel. Bekijk binnen 47 seconden een rapport per alinea. Tot 2.500 woorden gratis; Pro voor bulk; Enterprise voor corpus + eigen infrastructuur.