Wir machen das seit 2014.
Zwölf Jahre Plagiatserkennung. Von einer Wohnung in Kiew zum Hauptsitz in San Francisco, durch einen Accelerator in New York, eine Million Prüfungen und einen bewussten Neustart. So kam Noplag hierher — und dahin geht es weiter.
Wir haben Noplag 2014 in Kiew gestartet, weil jeder Plagiatsprüfer, den wir kannten, entweder nur für Institutionen, zu teuer oder eine Blackbox war. Keiner erklärte wirklich, warum eine Stelle markiert wurde.
Wir bauten eine freie Version, machten sie öffentlich und lernten, was die Leute wirklich brauchten: Nicht nur eine Punktzahl, sondern die Quelle. Nicht nur eine Zahl, sondern einen Prüfpfad. Zwölf Jahre und einen Neustart später versuchen wir, das weiter umzusetzen.
Zwölf Jahre, wichtige Meilensteine.
- 2014
Gegründet
Noplag als kostenloser Plagiatsprüfer aus einer Wohnung in Kiew gestartet. Die erste Version prüfte Klartext gegen Google-Suchergebnisse über einen drehenden Proxy-Pool. Die ersten 100 Nutzer kamen in drei Wochen.
- 2015
100.000 Prüfungen · erste institutionelle Pilotprojekte
Drei kleine US-Colleges nutzten Noplag für studentische Arbeiten. .docx- und .pdf-Upload hinzugefügt. Gelernt: Für gescannte PDFs ist OCR nötig — ein Problem, das wir auch zehn Jahre später noch angehen.
- 2016
Dokument-Konvertierungspipeline
Die unoconv + pdf2html-Kette gebaut, die jedes Eingabeformat in indiziertes HTML umwandelt. Volltextsuche mit Sphinx. Die Zustandsmaschine — Upload → Konvertieren → Analysieren → Suchen → Bericht — wurde in diesem Jahr entwickelt und besteht bis v5.0.
- 2017
Mehrsprachige Abdeckung
Spanisch und Portugiesisch hinzugefügt. Über den Support gemerkt: Nicht-muttersprachliche Autoren wurden häufiger markiert — ein frühes Symptom eines branchenweiten Problems.
- 2018
NY EdTech-Accelerator · $200K Startfinanzierung
Teilgenommen an einem New Yorker Accelerator für Bildungstechnologie. $200.000 von Angel-Investoren bekommen. Aufbau des Dashboards in React 16, WebSocket-gesteuerte Statusanzeigen und die erste Ordner-Struktur.
- 2019
1.000.000 Prüfungen · 4.700 Nutzer im Freitarif
Die Millionengrenze überschritten. Nutzer im Freitarif auf 4.700 gewachsen. Begonnen, Stripe und PayPal einzubinden. Der Code aus dieser Zeit ist das v1-Erbe, das wir für v5.0 neu aufgebaut haben.
- 2020
Aktive Entwicklung pausiert
Wir haben eine Pause gemacht, um nachzudenken, wie es weitergeht. ChatGPT erschienen. KI-Generierter Content wurde das neue Hauptthema. Plagiatserkennung ohne KI-Erkennung wirkte nicht mehr ausreichend. Wir haben beobachtet, mit Nutzern gesprochen, Ideen notiert.
- Mai 2022
Hauptsitz nach San Francisco verlegt
Drei Monate nach dem Einmarsch in die Ukraine ist ein Mitgründer nach San Francisco gezogen und hat den Firmensitz dort neu aufgebaut. Die Entwicklung lief weiter aus Kiew mit dem Rest des Teams.
- Aug 2023
Mitgründer in San Francisco wiedervereint
Der zweite Mitgründer kam nach San Francisco, nachdem er aufgrund medizinischer Gründe aus den ukrainischen Streitkräften entlassen wurde (Dienstbeginn Anfang 2022). Die Planung für den Neustart begann ernsthaft.
- 2024
Neustart beginnt
Entschieden, mit einer Open-Source-First-Architektur neu zu beginnen. Für die Engine fiel die Wahl auf Python + FastAPI, für die Oberflächen auf React/Next.js und für den Kern auf Apache 2.0. Die Überzeugung: Prüfbarkeit ist dem Black-Box-Ansatz in den kommenden zehn Jahren am Markt überlegen.
- 2025
Engine v1 · Layer W · Cloud-Korpus
Das vierstufige Retrieval-Cascade-Design (Winnowing → MinHash → Embeddings → Neusortierung) entwickelt und die erste Stufe ausgeliefert, 3 Such-Engines integriert, Common Crawl und 8 akademische Indizes eingespielt. MinHash (v1.1), Embeddings (v1.2) und Binoculars-basierte AI-Erkennung (v1.2) sind in Entwicklung.
- 2026
Launch v5.0
LIVENoplag ist zurück. Apache 2.0-Engine auf GitHub, Cloud-Tarif auf noplag.com, vier Preismodelle, Dashboard von Grund auf, und Noplag Database — anonymisierte Fingerprints, die mit jeder Prüfung wachsen. Das ist der Stand.
Drei Zusagen, die bleiben.
Nachvollziehbar
Die Erkennungs-Engine ist Apache 2.0. Sie können den Code lesen, forken und auf eigener Hardware ausführen. Vertrauen sollte nicht auf bloßem Versprechen beruhen.
Ehrlich
KI-Erkennung ist ein Signal, kein Urteil. Jede Übereinstimmung zeigt die Quelle. Für Nicht-Muttersprachler gibt es explizite Hinweise. Wir behaupten keine Genauigkeit, die wir nicht messen.
Ihr Eigentum
Ihre Dokumente werden nie zum Training genutzt. EU-Residenz möglich. Löschung mit einem Klick. Das Korpus-Wachstum basiert auf Zustimmung.
Eine kleine Gruppe mit langer Erfahrung.
Ursprünglich drei Ingenieure in Kiew. Heute Hauptsitz in San Francisco, Teams für Entwicklung und Forschung in der Ukraine, Polen und Spanien — plus eine Bibliothekarin, die sich auf das akademische Korpus konzentriert.
Alle kennenlernenMöchten Sie Teil der nächsten Schritte sein?
Testen Sie den kostenlosen Tarif, verfolgen Sie die Engine auf GitHub, treten Sie dem Discord bei oder melden Sie sich für Enterprise. Wir antworten auf alles.