Nous faisons cela depuis 2014.
Douze ans de détection de plagiat. D’un appartement à Kyiv au siège à San Francisco, via un accélérateur à New York, un million de vérifications, et une reconstruction volontaire. Voilà comment Noplag en est arrivé là — et où il va ensuite.
Nous avons lancé Noplag à Kyiv en 2014 parce que chaque détecteur de plagiat que nous trouvions était réservé aux institutions, beaucoup trop cher, ou opaque. Aucun n’expliquait vraiment pourquoi un passage était signalé.
Nous avons construit une version gratuite, ouverte, et appris ce dont les gens avaient réellement besoin : pas juste un score, mais la source. Pas juste un chiffre, mais une traçabilité. Douze ans et une reconstruction plus tard, c’est toujours cet objectif.
Douze ans en étapes clés.
- 2014
Fondé
Noplag lancé comme détecteur de plagiat gratuit depuis un appartement à Kyiv. Première version analysait du texte brut sur Google via un pool de proxies. Les 100 premiers utilisateurs en trois semaines.
- 2015
100 000 vérifications · premiers pilotes institutionnels
Trois petits établissements américains adoptent Noplag pour le travail étudiant. Ajout du support .docx et .pdf. Découverte : les PDF scannés nécessitent de l’OCR — problème encore présent dix ans plus tard.
- 2016
Chaîne de conversion documentaire
Montage du pipeline unoconv + pdf2html pour convertir tout format entrant en HTML indexé. Backend de recherche Sphinx en texte intégral. La machine à états — Importer → Convertir → Analyser → Rechercher → Rapporter — qui arrive jusqu’à la v5.0 date de cette année-là.
- 2017
Couverture multilingue
Ajout de l’espagnol et du portugais. Support client : des auteurs non natifs voient plus de signalements — premiers indices d’un problème qui touchera tout le secteur plus tard.
- 2018
Accélérateur EdTech à NY · 200 000 $ de levée
Participation à un accélérateur EdTech à New York. Levée de 200 000 $ auprès de business angels. Conception du tableau de bord React 16, UX de suivi en WebSocket, premières organisations par dossiers.
- 2019
1 000 000 vérifications · 4 700 utilisateurs gratuits
Cap du million de vérifications passé. Part d’utilisateurs gratuits à 4 700. Début de l’intégration de paiement Stripe/PayPal. Le code de cette époque devient la v1 legacy qui servira à la v5.0.
- 2020
Développement actif suspendu
Mise en pause pour réfléchir à la suite. ChatGPT arrive. Les contenus générés par IA deviennent la question dominante. Détecter le plagiat sans détecter l’IA paraît incomplet. Observation du secteur, retours clients, prise de notes.
- mai 2022
Le siège déménage à San Francisco
Trois mois après l’invasion de l’Ukraine, un cofondateur part s’installer à San Francisco et y rétablit le siège. L’équipe d’ingénierie reste active à Kyiv.
- août 2023
Cofondateurs réunis à San Francisco
L’autre cofondateur rejoint l’équipe à San Francisco après avoir été démobilisé des forces armées ukrainiennes, en service depuis 2022. La planification de la reconstruction commence vraiment.
- 2024
Début de la reconstruction
Choix de repartir sur une architecture open source dès la conception. Moteur en Python + FastAPI, interfaces en React/Next.js, cœur sous licence Apache 2.0. Pari sur la transparence et l’auditabilité plutôt que sur l’opacité pour la prochaine décennie du marché.
- 2025
Moteur v1 · Layer W · corpus cloud
Conception de la cascade de récupération en quatre couches (winnowing → MinHash → embeddings → reranking) et mise en production de la première couche, intégration de 3 moteurs de recherche, ingestion de Common Crawl et de 8 index académiques. MinHash (v1.1), embeddings (v1.2) et détection de contenu IA basée sur Binoculars (v1.2) sont en cours de développement.
- 2026
Lancement de la v5.0
EN LIGNENoplag revient. Moteur Apache 2.0 sur GitHub, version cloud sur noplag.com, quatre offres tarifaires, tableau de bord repensé, et le Noplag Database — empreintes anonymisées qui grandissent à chaque vérification. Nous y sommes.
Trois engagements qui ne changeront pas.
Auditabilité
Le moteur de détection est Apache 2.0. Lisez le code, dupliquez-le, faites-le tourner chez vous. La confiance ne doit pas dépendre de notre parole.
Honnêteté
Détection IA : c’est un signal, pas un verdict. Chaque correspondance cite sa source. Les auteurs non natifs ont une mention claire. Nous n’affirmons pas une fiabilité que nous ne pouvons pas mesurer.
À vous
Vos documents ne sont pas utilisés pour l’entraînement. Résidence UE disponible. Droit à l’effacement en un clic. Le corpus est construit sur le consentement.
Petit groupe qui travaille là-dessus depuis longtemps.
À l’origine, trois ingénieurs à Kyiv. Aujourd’hui, siège à San Francisco, équipes ingénierie/recherche en Ukraine, Pologne, Espagne — plus un bibliothécaire à temps complet pour le corpus académique.
Voir toute l’équipeEnvie de rejoindre la suite du projet ?
Essayez la version gratuite, suivez le moteur sur GitHub, rejoignez le Discord, ou contactez-nous pour l’Enterprise. Nous répondons à tout.