Logiciel anti-plagiat pour cabinets juridiques, contrôle dossiers
Contrôle pré-dépôt pour mémoires, notes et requêtes. Détecte les reprises non attribuées, le contenu-type réutilisé, et les textes rédigés par IA (avec le risque de cas inventé associé). Secret professionnel préservé : auto-hébergez le moteur sur votre réseau ou choisissez l’option résidence UE pour les questions transfrontalières. Les documents ne servent jamais à l’entraînement. Jamais.
Quatre fonctions. Un contrôle avant dépôt.
Contrôle mémoire avant revue associée
Repérez la paraphrase omise sans citation Bluebook avant le partenaire.
- Contrôle personnel avant la validation par le partenaire
- Classification citation-aware Bluebook + ALWD
- Probabilité IA par paragraphe (si LLM utilisé)
Vérification prête à déposer
C’est votre signature. L’originalité doit l’être aussi.
- Liste interne des citations autorisées (vos anciens mémoires)
- Détection de cas inventés (Mata c. Avianca était un avertissement)
- Piste d’audit par collaborateur pour prévention du risque professionnel
Workflow note + préparation dossier
Contrôle en masse des notes et réponses de découverte avant intégration au dossier.
- Dossier par affaire · isolation des fichiers
- Résidence UE pour découverte transfrontalière
- Moteur Apache 2.0 — défendable lors du contrôle des conflits
Application de la politique IA de la firme
Vérifiez l’effectivité de la politique IA en vigueur.
- Détection IA sur l’ensemble de la production sortante
- Logs de droit à l’effacement pour contrôle confidentialité
- Auto-hébergement dans le réseau interne — secret préservé
Trois étapes avant le clic e-filing.
Auto-hébergé dans le réseau du cabinet, endpoint résidence UE pour l’international, ou cloud Pro avec isolation stricte. Choisissez selon le niveau de confidentialité requis.
01 · Rédiger en interne
Téléversez le mémoire / note / requête (.docx conseillé ; .pdf accepté). Le dépôt reste dans l’espace privé du cabinet — contrôle d’accès préservant le secret, pas de corpus partagé, aucune fuite inter-clients. En auto-hébergement : le document ne quitte jamais votre VPC.
02 · Contrôle des bonnes sources
La cascade vérifie sur web ouvert + Common Crawl + archives d’avis publiques (CourtListener, CAP, Google Scholar, Justia). Classification des citations pour distinguer les vraies citations format Bluebook des paraphrases non citées. Probabilité IA par paragraphe — intérêt car risque de cas inventé réel.
03 · Vérifier avant dépôt
Le rapport classe chaque intervalle : CITÉ·ATTRIBUÉ (citation Bluebook, exclue), JUGEMENT·CITÉ (nom complet + référence, exclu), PARA·CITÉ (paraphrase citée, poids faible), NON-CITÉ·PARA (à revoir), PROBABLE·IA (à vérifier ou réécrire), RISQUE·INVENTÉ (cas cité introuvable — contrôle avant dépôt).
Six points à vérifier avant de déposer un mémoire ayant impliqué une IA.
Mata c. Avianca (S.D.N.Y. 2023) a servi d’avertissement : six affaires inventées par ChatGPT cités, 5 000 $ de sanction et blâme public. La rédaction par IA exige sa propre couche de vérification.
01 · EXISTENCE CITATION
Chaque citation est vérifiée dans les archives d’avis publics (CourtListener, CAP, Scholar, Justia). Si aucune correspondance sur les quatre, RISQUE-INVENTÉ remonté. Cela ne signifie pas systématiquement que le cas est fictif (peut être non publié, scellé ou sous paywall). Cela implique : vérifiez avant dépôt.
02 · FIDÉLITÉ DE LA CITE
Si un extrait est cité, le moteur vérifie le texte cité avec l’opinion d’origine. Cas existe mais la citation textuelle n’apparaît pas : DÉRIVE-CITATION — erreur classique de LLM. Drapeau distinct de l’existence de la citation.
03 · EXACTITUDE DU PINCITE
Vérification des pages citées à l’intérieur d’un arrêt. La page référencée contient-elle le texte cité ou non. Cas courant du LLM : bon arrêt, bon numéro de page, mauvais paragraphe. Drapeau PINCITE-ERREUR.
04 · PORTÉE VS DICTUM
Fonctionnalité bêta (Pro+). Le moteur signale si la citation invoque le cœur de l’arrêt (portée) ou un simple dictum. Assimiler un dictum à la portée : erreur fréquente IA, risque professionnel associé.
05 · ANNULÉ / REJUGÉ
Historique des citations via CourtListener. Si un cas cité est annulé, infirmé ou distingué par jurisprudence ultérieure, cela apparaît dans le rapport. Un arrêt correctement cité peut ne plus faire autorité.
06 · PARAGRAPHES PROBABLE·IA
Probabilité par paragraphe IA (métrique Binoculars) bientôt disponible — prévu, non actif au lancement. Les paragraphes signalés sont à vérifier humainement avant dépôt. Ajustement ESL pour cabinets à avocats non-anglophones — l’étiquette « ESL ADJ » remplace « LIKELY-AI » si la signature lexicale le justifie.
Ce que vous voyez avant de cliquer sur e-filing.
Classification par paragraphe : cas cités vérifiés, paraphrases attribuées ou non, paragraphes signalés IA et le drapeau RISQUE-INVENTÉ pour tout cas introuvable.
Trois besoins du secret avocat-client pour un vérificateur.
Le moteur fonctionne dans votre réseau
Apache 2.0 + Docker. Utilisable avec votre Postgres + Redis en interne. Le dépôt, la base d’empreintes et le rapport restent sur vos serveurs. Zéro trafic sortant. Solution adaptée aux dossiers sous ordonnance de protection, dépôt scellé ou brouillons couverts par work-product.
Pour les dossiers transfrontaliers UE
Pro+ déployé sur api.eu.noplag.com. Hébergé dans les centres Hetzner UE (Falkenstein + Helsinki). Le dépôt, l’empreinte et le rapport ne quittent pas l’UE. Conformité RGPD par défaut ; DPA disponible sur demande. Utile pour représentations EU/UK, dossiers RGPD ou clients domiciliés UE.
Les mémoires soumis ne servent pas à l’entraînement
Les brouillons sont fingerprintés (hash winnowing, signature non réversible) et stockés en base isolée par client. Le texte est purgé après 30 jours sauf demande de rétention. Détecteurs pré-entraînés sur corpus public — aucun doc cabinet n’est ajouté à l’entraînement. Clairement indiqué dans la DPA.
Deux exigences du multi-juridiction que les outils mono-juridiction ratent.
La plupart des détecteurs sont pensés pour une seule juridiction — souvent droit fédéral US. Les dossiers transfrontières croisent plusieurs archives d’avis (US fédéral + états US + EU + UK + Commonwealth), plusieurs normes (Bluebook, OSCOLA, McGill Guide, AGLC) et plusieurs langues (rédaction juridique en français, allemand, espagnol, portugais pour l’Amérique du Sud). La cascade gère tout cela. L’endpoint résident UE gère la localisation des données. L’auto-hébergement gère les cas où le cloud ne suffit pas.
Lire le guide dossiers transfrontaliersCe que demandent les managing partners avant achat.
- Nos mémoires servent-ils à l’entraînement ?
- Non. Les brouillons sont fingerprintés (hash winnowing, non réversible) et stockés dans une base isolée par client. Le texte est purgé après 30 jours sans rétention activée. Modèles pré-entraînés sur corpus public ; aucun document cabinet n’intègre un set d’entraînement. DPA explicite. L’auto-hébergement garde tout en interne — même les empreintes restent sur place.
- La détection de cas inventés fonctionne comment ?
- Chaque cas + référence de la mémoire est vérifié sur quatre archives : CourtListener, CAP (Harvard), Scholar, Justia. Si zéro correspondance sur les quatre, rapport signalé RISQUE-INVENTÉ. Cela ne veut pas dire case fictive — peut être non publiée, scellée, paywall — mais implique de vérifier sur Westlaw / Lexis avant dépôt. Mata c. Avianca a motivé cette vérification.
- Couvre le droit hors-US ?
- Fédéral US + états, UK + Commonwealth (style OSCOLA), Canada (McGill Guide), Australie (AGLC), UE (CJUE + CEDH). La cascade indexe Bailii (UK), CanLII (Canada), AustLII, et Curia UE. Vieux arrêts sous paywall (Westlaw / Lexis / juris) seront manquants — même défaut que iThenticate côté académique payant.
- Quel est l’argument secret professionnel ?
- Trois niveaux : Pro cloud : base isolée, résidence UE, purge 30 jours. Endpoint UE (api.eu.noplag.com) : tout hébergé dans les centres Hetzner, sous-traitant RGPD art.28. Auto-hébergé : Apache 2.0 + Docker, dans votre VPC, zéro trafic sortant. Choisissez selon l’ordonnance de protection du dossier.
- Gère correctement les citations Bluebook ?
- Oui — Bluebook 21e éd., plus ALWD, OSCOLA (UK), McGill (Canada), AGLC (Australie). Format détecté des références du mémoire. Les cas correctement cités sont exclus du score. Citations mal formatées sont signalées séparément — non comme plagiat, mais comme dérive de forme à corriger.
- Et pour la découverte sous ordonnance de protection ?
- Auto-hébergez le moteur — Apache 2.0 + Docker. Les documents sensibles, dépositions scellées, et contenus secrets ne vont jamais dans un cloud tiers même marqué comme sécurisé. L’option auto-hébergée, c’est : « ne quitte jamais votre VPC » — pas « faites confiance à notre cloud ». Ce déploiement est la norme en contentieux commercial.
- Le détecteur IA résiste-t-il à une audience sanction ?
- Détection IA bientôt disponible — sur la roadmap, non lancé — mais méthodologie ouverte (Binoculars, Hans et al. 2024, article évalué). Chaque paragraphe signalé portera le commit engine et snapshot corpus. Relance sur même commit : verdict reproductible. Les détecteurs IA propriétaires ratent ce test — leurs résultats sont parfois écartés au tribunal (Daubert) faute de méthode vérifiable. Le nôtre l’est ; on ne prétend pas que le verdict est parfait, mais il est défendable.
- Tarif pour un cabinet de 40 avocats ?
- Premium à 79 $/mois : par avocat, 5 000 mots/analyse, 5 000 docs/mois, API REST + intégrations LMS. Pour gros volumes (10 000+ docs/mois), contrat Enterprise négocié sur taille corpus + infra dédiée. La tarification n’est pas au siège — c’est le volume traité qui compte.
- Peut-on s’intégrer à notre gestion documentaire (iManage, NetDocuments, OpenText) ?
- Le niveau Pro+ propose une intégration via webhook et API REST. iManage et NetDocuments prennent en charge les webhooks sortants lors de l’enregistrement d’un document ; configurez le webhook pour effectuer un POST vers /v1/checks ; le rapport est joint au document en tant que champ de métadonnées. OpenText eDOCS propose la même fonctionnalité via les hooks de Content Server. Des scripts d’intégration pour les trois solutions sont disponibles sur github.com/NoplagLabs/noplag-engine/integrations.
- Pour l’ediscovery — adapté au contrôle de pièces produites ?
- Cas d’usage distinct — ediscovery vise la classification (responsive / non-responsive / confidentiel), pas la vérification anti-plagiat de vos mémoires. Noplag n’est pas une plateforme d’ediscovery (Relativity / Everlaw / Disco dominent le secteur). Pour garantir que vos productions sont originales et sans IA, Noplag s’adapte.
Passez votre mémoire dans la cascade. Avant dépôt.
Déposez mémoire ou requête. Rapport paragraphe par paragraphe : vérification des citations, détection cas inventé, indice IA. Gratuit jusqu’à 2 500 mots ; Pro pour volume cabinet ; Enterprise pour auto-hébergement + infra dédiée.