POSITIONDétection — pas génération.

Détecteur de paraphrase — repérez la copie déguisée

Un détecteur de paraphrase repère les textes reformulés pour masquer leur origine. Noplag détecte aujourd'hui les cas légers : les modifications qui laissent des séquences de cinq mots intactes sont toujours reconnues, donc les substitutions de synonymes et les petits changements d'ordre sont trouvés par l'empreinte winnowing et vérifiés par une recherche web en direct. La réécriture phrase par phrase est un autre problème et nous ne la détectons pas encore — la détection de quasi-duplication (v1.1) et la correspondance sémantique (v1.2) sont prévues pour cela, et seront disponibles après validation par évaluation publique.

0 / 1,500 words
Détecte la reformulation légèreMoteur open sourceTransparence sur ce qui n'est pas détecté
NOTRE POSITION

Nous détectons. Nous n'aidons pas à contourner.

Un humanizer est un outil qui réécrit un texte, qu'il soit rédigé par une IA ou un humain, dans le but de contourner la détection. Nous pourrions en développer un. Nous ne le faisons pas. L'objectif de ce produit est de révéler les copies non attribuées, pas d'aider à les masquer. Pour que la détection ait un sens, ceux qui conçoivent les détecteurs et ceux qui créent les humanizers ne doivent pas être le même fournisseur. Nous avons choisi notre position.

Quand nous mentionnons les humanizers dans le rapport, c'est pour signaler leur existence et indiquer qu'ils ont pu être utilisés en amont du texte analysé — pas pour en vendre.

OUTILS AVEC LESQUELS NOUS NE SOMMES PAS EN CONCURRENCE
QuillbotUndetectableStealthGPTHumbotAIHumanizeWalter Writes
FONCTIONNEMENT DE LA DÉTECTION SÉMANTIQUE

Quatre couches. Deux disponibles, deux en développement.

La cascade va de la correspondance exacte à la quasi-duplication, puis à l’équivalence sémantique, avant une vérification croisée sur le web ouvert. Deux de ces couches sont incluses dans la v1.0 ; les deux dédiées à la détection réelle de paraphrase sont encore en développement, et nous préférons l’indiquer clairement.

L1

Empreintes winnowing — disponible

DÉTECTE

Correspondances exactes de sous-chaînes. Substitutions légères de synonymes et petits changements d’ordre qui laissent des séquences de cinq mots intactes.

NE DÉTECTE PAS

Tout ce qui est réordonné ou reformulé.

L2

MinHash LSH — feuille de route v1.1

DÉTECTE

Détectera le réagencement de phrases et le mélange des mots. Non détecté à ce jour.

NE DÉTECTE PAS

Vrais synonymes et réécritures sémantiques, ce qui relève de L3.

L3

Embeddings de phrases — feuille de route v1.2

DÉTECTE

Détectera la substitution de synonymes et la paraphrase sémantique. Non détecté à ce jour.

NE DÉTECTE PAS

Réécritures suffisamment éloignées de la source pour qu’aucun signal statistique ne subsiste.

LW

Vérification croisée en direct sur le web — disponible

DÉTECTE

Sources apparues après la capture du corpus.

NE DÉTECTE PAS

Contenu payant ou non indexé.

COUVERTURE DE DÉTECTION

Ce que nous détectons aujourd'hui — selon l'intensité du paraphrasage.

Il s'agit du comportement en v1.0, pas d'une projection. Une légère modification laisse encore des passages détectables ; une réécriture approfondie non, et aucune technique d'empreinte ne permet de les retrouver. Nous avons détaillé la limite exacte dans notre article sur les limites honnêtes de la détection du texte mot à mot : /blog/the-honest-limits-of-verbatim-detection.

LÉGER
Ouidans la v1.0 aujourd'hui

Remplacement de synonymes et légers changements d'ordre. Assez de formulation d'origine subsiste pour que les empreintes correspondent.

ORIGINAL

Le chat était assis sur le tapis.

PARAPHRASÉ

Le félin était assis sur le tapis.

MODÉRÉ
En partiedans la v1.0 aujourd'hui

Phrase restructurée, verbes modifiés. Détecté seulement si un passage intact subsiste. La détection de quasi-duplication (v1.1) vise ce niveau.

ORIGINAL

Le chat était assis sur le tapis.

PARAPHRASÉ

Sur le tapis, le chat s'était installé.

FORT
Nondans la v1.0 aujourd'hui

Réécriture complète du sens, nouvelle structure et vocabulaire. Score nul actuellement ; la correspondance sémantique (v1.2) ciblera ce niveau.

ORIGINAL

Le chat était assis sur le tapis.

PARAPHRASÉ

Un petit mammifère s'était installé sur une surface en tissu.

QUESTIONS FRÉQUENTES

Dix questions sur la détection du plagiat par paraphrase.

Principalement sur les limites de la détection. Nous précisons le seuil minimal ; ceux qui doivent le savoir sont ceux qui vont agir sur un score.

Quelle est la différence entre la détection de la paraphrase et la détection du plagiat ?
Le plagiat est la catégorie générale — copier un texte sans citation. La détection de la paraphrase vise à repérer le plagiat après réécriture pour masquer l’origine. Noplag traite les deux dans un même rapport ; la détection de la paraphrase intervient quand la couche L1 de correspondance exacte ne détecte rien.
Pourquoi la paraphrase lourde est-elle si difficile à détecter ?
La détection repose sur des signaux statistiques — séquences de mots partagées, puis structure et sens communs. Une modification légère laisse ces séquences intactes, donc elles sont détectées. Si on réécrit phrase par phrase, les séquences disparaissent : une paraphrase complète donne un score nul avec un moteur d’empreintes, ce qu’est la v1.0. C’est une limite de la méthode, pas un bug, et c’est pourquoi la détection de quasi-duplication (v1.1) et la détection sémantique (v1.2) sont des couches distinctes, pas un simple réglage. Voir notre article sur les limites honnêtes de la détection littérale : /blog/the-honest-limits-of-verbatim-detection.
Noplag propose-t-il un outil pour humaniser un texte généré par IA ?
Non. Nous ne proposons pas d’outil de « humanisation ». Le but d’un tel outil est de contourner la détection — c’est contraire à notre mission. Nous sommes du côté de l’intégrité ; nous détectons, nous n’aidons pas à dissimuler. Voir la note de position ci-dessus.
Comment cela se compare-t-il à l’outil de paraphrase de Quillbot ?
Quillbot réécrit le texte pour contourner la détection. Nous détectons les textes réécrits pour échapper à la détection. Nous sommes à l’opposé sur le même problème. Si un texte issu de Quillbot est analysé, le rapport signalera « utilisation possible d’un outil de paraphrase » si nous reconnaissons la signature.
Qu’est-ce qu’une « cascade à quatre couches » et lesquelles sont actives ?
Quatre passes de détection, de moins en moins littérales. L1 filtre les correspondances exactes ou légèrement modifiées, et Layer W vérifie via la recherche web en direct — ces deux couches sont disponibles en v1.0. L2 (quasi-duplication) est prévue pour v1.1 et L3 (détection sémantique par embeddings de phrases) pour v1.2 ; aucune des deux n’est active aujourd’hui, ni présente dans le dépôt public. Résumé honnête : la moitié de la cascade est en production, celle qui traite la reformulation légère.
Qu’en est-il de la traduction automatique aller-retour comme technique de paraphrase ?
La traduction aller-retour (anglais → espagnol → anglais) est l’un des types de paraphrase les plus difficiles — équivalent sur le fond mais structurellement différent. Si des séquences du texte original subsistent, nous les détectons ; si la réécriture est complète, nous ne la détectons pas aujourd’hui. C’est une cible pour la couche sémantique en v1.2.
Allez-vous signaler une paraphrase lourde comme « plagiat » ?
Seulement si le niveau de confiance est suffisant. En dessous du seuil, nous signalons le passage suspect comme « correspondance à faible confiance » et laissons l’évaluateur décider. Nous ne déclarons jamais un plagiat par paraphrase de façon unilatérale — nous indiquons une probabilité et l’explication.
Puis-je voir comment Noplag a évalué un passage ?
Oui. Chaque correspondance dans le rapport renvoie à l’URL source et indique quelle couche de détection a été activée. Vous pouvez reproduire le score hors ligne via le moteur open source — voir /open-source-plagiarism-checker.
Noplag fonctionne-t-il pour la paraphrase dans d’autres langues que l’anglais ?
La détection est calibrée pour l’anglais, l’espagnol, le portugais, le polonais et l’ukrainien au lancement, d’autres langues suivront. Les autres langues affichent des résultats signalés « faible ressource — interpréter avec prudence ».
Le détecteur de paraphrase est-il gratuit ?
Oui sur l’offre gratuite — 2 500 mots par vérification, sans inscription. Les offres Pro et Premium augmentent la limite ; l’algorithme de détection reste identique sur toutes les offres.

Détectez le plagiat par paraphrase — gratuit jusqu’à 2 500 mots.

Nous détectons aujourd'hui les reformulations légères et indiquons clairement que les réécritures approfondies ne sont pas repérées tant que les couches sémantiques ne sont pas en place. Lancez une vérification sur votre propre texte et consultez les résultats réels du moteur.

Détecter le plagiat par reformulation
Détecteur de paraphrase — Repérez le plagiat reformulé | Noplag