POZICEDetekce — ne generování.

Detektor parafrázování — najděte skryté kopírování

Detektor parafrázování najde text, který byl přeformulován za účelem skrytí zdroje. Noplag dnes zachytí lehčí případy: úpravy, kde zůstávají zachovány pětislovné úseky, stále odpovídají, takže záměny synonym a drobné změny pořadí slov odhalí winnowing fingerprinty a ověření přes aktuální webové vyhledávání. Důkladné přepisování vět je jiný problém a zatím ho nedetekujeme — řeší ho párování téměř shodných textů (v1.1) a sémantické párování (v1.2), které budou dostupné po zveřejnění výsledků hodnocení.

0 / 1,500 words
Odhalí lehké přeformulováníOpen-source engineOtevřeně uvádí, co nezachytí
NAŠE POZICE

Detekujeme. Nepomáháme obcházet.

Humanizer je nástroj, který přepisuje AI nebo lidský text tak, aby obešel detekci. Mohli bychom ho vytvořit. Neděláme to. Smyslem tohoto produktu je odhalovat nepřiznané kopírování, ne ho skrývat. Pokud má být detekce užitečná, provozovatelé detektorů a tvůrci humanizerů nemohou být jeden dodavatel. My jsme si vybrali.

Pokud v reportu zmiňujeme humanizery, je to proto, abychom vás informovali, že existují a mohly být použity před tím, než k vám text dorazil — ne proto, abychom vám je nabízeli.

NÁSTROJE, SE KTERÝMI NEBUDEME SOUTĚŽIT
QuillbotUndetectableStealthGPTHumbotAIHumanizeWalter Writes
JAK FUNGUJE SÉMANTICKÁ DETEKCE

Čtyři vrstvy. Dvě dostupné, dvě ve vývoji.

Postupné filtrování od přesné shody přes téměř totožné texty až po sémantickou ekvivalenci, nakonec ověření proti otevřenému webu. Dvě vrstvy jsou součástí v1.0; dvě pro detekci skutečné parafráze se teprve vyvíjejí a raději to přiznáme, než abychom naznačovali opak.

L1

Winnowing otisky — dostupné

ZACHYTÍ

Přesné shody podřetězců. Mírné záměny synonym a drobné změny pořadí, pokud zůstávají zachovány úseky o pěti slovech.

NEZACHYTÍ

Cokoli přeřazené nebo přeformulované.

L2

MinHash LSH — plánováno pro v1.1

ZACHYTÍ

Bude detekovat změny pořadí vět a přeskládání slov. Aktuálně není podporováno.

NEZACHYTÍ

Skutečná synonyma a sémantické přepisy, což řeší až L3.

L3

Větné embeddingy — plánováno pro v1.2

ZACHYTÍ

Bude detekovat záměnu synonym a sémantické parafrázování. Aktuálně není podporováno.

NEZACHYTÍ

Přepisy natolik vzdálené od zdroje, že nezůstává žádný statistický signál.

LW

Kontrola proti aktuálnímu webu — nasazeno

ZACHYTÍ

Zdroje přidané po vytvoření snímku korpusu.

NEZACHYTÍ

Obsah za paywallem nebo nezaindexovaný.

ROZSAH DETEKCE

Co dnes zachytíme — podle míry parafrázování.

Toto je chování ve verzi v1.0, ne odhad. Při lehkých úpravách zůstávají v textu úseky, které lze najít; při důkladném přepracování už ne, a žádné otisky je neobnoví. Podrobně jsme popsali hranici v článku o reálných limitech detekce doslovných shod: /blog/the-honest-limits-of-verbatim-detection.

LEHKÉ
Anove v1.0 dnes

Záměna synonym a drobné změny slovosledu. Část původního znění zůstává a lze ji najít otisky.

PŮVODNÍ

Kočka seděla na rohožce.

PARAFRÁZOVÁNO

Felina seděla na rohožce.

STŘEDNÍ
Částečněve v1.0 dnes

Věta přeformulována, změna sloves. Zachytí se jen, pokud zůstane část beze změny. Vyhledávání téměř shodných textů (v1.1) cílí na tuto úroveň.

PŮVODNÍ

Kočka seděla na rohožce.

PARAFRÁZOVÁNO

Na rohožce se usadila kočka.

SILNÉ
Neve v1.0 dnes

Úplné přepracování významu, nová struktura a slovní zásoba. Dnes skóre nula; sémantické porovnání (v1.2) cílí na tuto úroveň.

PŮVODNÍ

Kočka seděla na rohožce.

PARAFRÁZOVÁNO

Malý savec se usadil na textilním povrchu.

ČASTÉ DOTAZY

Deset otázek k detekci parafrází.

Většinou o tom, kde detekce selhává. Otevřeně uvádíme limity; potřebují je znát ti, kdo se chystají rozhodovat na základě výsledku.

Jaký je rozdíl mezi detekcí parafrází a detekcí plagiátorství?
Plagiátorství je širší pojem — jde o kopírování textu bez uvedení zdroje. Detekce parafrází je konkrétní úkol: odhalit plagiátorství i po přeformulování textu, které má zamaskovat původ. Noplag zvládá obojí v jednom reportu; detekce parafrází se spouští, když vrstva L1 (přesná shoda) nenajde výsledek.
Proč je těžké odhalit silně parafrázovaný text?
Detekce funguje na základě statistických znaků — shodných úseků slov, později i struktury a významu. Při lehkých úpravách tyto úseky zůstávají, takže jsou zachyceny. Pokud ale někdo text přeformuluje větu po větě, shodné úseky zmizí: důkladná parafráze má u fingerprintového enginu (což je v1.0) skóre nula. To je vlastnost metody, ne chyba, a proto jsou vrstvy pro téměř shodné (v1.1) a sémantické (v1.2) shody oddělené, ne jen jako nastavení citlivosti. Podrobněji v našem článku o limitech detekce doslovných shod: /blog/the-honest-limits-of-verbatim-detection.
Nabízí Noplag nástroj na „zlidštění“ AI textu?
Ne. Nástroj na zlidštění neposkytujeme. Jeho účel je obejít detekci — to je v rozporu s naším cílem. Jsme na straně integrity; detekujeme, nepomáháme skrývat. Viz stanovisko výše.
Jak se to liší od parafrázovacího nástroje Quillbot?
Quillbot přepisuje text tak, aby obešel detekci. My detekujeme text přepsaný za účelem obejití detekce. Jsme na opačných stranách stejného problému. Pokud se výstup Quillbotu objeví ve vaší kontrole, report označí 'možné použití parafrázovacího nástroje', pokud rozpoznáme typický vzor.
Co znamená 'čtyřvrstvová kaskáda' a které části už běží?
Čtyři detekční průchody, každý méně doslovný než předchozí. L1 winnowing zachytí přesné a lehce upravené shody, Layer W ověřuje přes živé webové vyhledávání — obojí je součástí v1.0. L2 (téměř shodné texty) je plánováno pro v1.1 a L3 (sémantické shody přes větné embeddingy) pro v1.2; ani jedna zatím neběží a nejsou ani ve veřejném repozitáři. Upřímné shrnutí: polovina kaskády je v provozu, a je to ta část, která zvládá lehké přeformulování.
Jak je to s parafrázováním pomocí zpětného překladu?
Zpětný překlad (např. angličtina → španělština → angličtina) patří mezi nejtěžší typy parafrází — význam zůstává, struktura je nová. Pokud zůstanou části původního znění, zachytíme je; pokud je překlad zcela přeformulovaný, dnes jej nedetekujeme. Je to cíl pro sémantickou vrstvu ve v1.2.
Označíte silně parafrázovaný text jako 'plagiát'?
Jen pokud je jistota dostatečně vysoká. Pod prahem zobrazíme podezřelý úsek s označením 'shoda s nízkou jistotou' a rozhodnutí necháme na posuzovateli. Nikdy neoznačujeme parafrázovaný plagiát jednostranně — uvádíme pravděpodobnost a odůvodnění.
Mohu vidět, jak Noplag ohodnotil konkrétní úsek?
Ano. Každá shoda v reportu odkazuje na zdrojovou URL a ukazuje, která detekční vrstva ji zachytila. Skóre si můžete ověřit offline pomocí open-source enginu — viz /open-source-plagiarism-checker.
Funguje Noplag i na parafrázování v jiných jazycích než angličtině?
Detekce je při spuštění kalibrovaná pro angličtinu, španělštinu, portugalštinu, polštinu a ukrajinštinu; další jazyky budou přibývat. Ostatní jazyky vrací výsledky označené 'nízké pokrytí — vykládejte s vyšší opatrností.'
Je detektor parafrází zdarma?
Ano ve free verzi — 2 500 slov na kontrolu, bez registrace. Pro a Premium verze zvyšují limit; detekční algoritmus je na všech úrovních stejný.

Najděte parafrázované plagiáty — zdarma, až 2 500 slov.

Dnes odhalíme jen mírné přeformulování a otevřeně přiznáváme, že důkladné přepracování textu nám uniká, dokud nebudou dostupné sémantické vrstvy. Ověřte si svůj vlastní text a přečtěte si, co náš engine skutečně našel.

Odhalte plagiát s přeformulovaným textem
Detekce parafrázování — Najděte přeformulované plagiáty | Noplag