POZYCJAWykrywanie — nie generowanie.

Wykrywacz parafrazowania — znajdź ukryte kopiowanie

Wykrywacz parafrazowania znajduje tekst przeredagowany w celu ukrycia źródła. Noplag obecnie wykrywa lżejsze przypadki: edycje, w których pięcio-wyrazowe fragmenty pozostają bez zmian, są nadal wykrywane, więc zamiany synonimów i drobne przestawienia są wykrywane przez odciski palca typu winnowing i sprawdzane w wyszukiwarce internetowej. Pełne przeredagowanie zdań to inny problem i nie wykrywamy go jeszcze — dopasowanie prawie identycznych fragmentów (v1.1) i dopasowanie semantyczne (v1.2) rozwiążą ten problem, gdy przejdą ocenę publiczną.

0 / 1,500 words
Wykrywa lekkie przeredagowanieSilnik open sourceJasno informuje, czego nie wykrywa
NASZE STANOWISKO

Wykrywamy. Nie pomagamy omijać wykrywania.

Humanizer to narzędzie, które przeredagowuje tekst napisany przez AI lub człowieka, by utrudnić wykrycie. Moglibyśmy je zbudować. Nie robimy tego. Celem tego produktu jest ujawnianie nieoznaczonego kopiowania, a nie jego ukrywanie. Jeśli wykrywanie ma mieć sens, dostawca wykrywaczy i humanizerów nie może być ten sam. Wybraliśmy swoją stronę.

Jeśli wspominamy o humanizerach w raporcie, to po to, by poinformować, że istnieją i mogły zostać użyte przed sprawdzanym tekstem — nie po to, by je sprzedawać.

NARZĘDZIA, Z KTÓRYMI NIE KONKURUJEMY
QuillbotUndetectableStealthGPTHumbotAIHumanizeWalter Writes
JAK DZIAŁA WYKRYWANIE SEMANTYCZNE

Cztery warstwy. Dwie dostępne, dwie w przygotowaniu.

Mechanizm stopniowo zawęża analizę: od dokładnych dopasowań, przez prawie identyczne fragmenty, do równoważności semantycznej, a na końcu sprawdza otwarty internet. Dwie z tych warstw są dostępne w wersji v1.0; dwie kolejne, wykrywające rzeczywiste parafrazy, są jeszcze w trakcie opracowania. Wolimy to jasno powiedzieć.

L1

Odciski palców Winnowing — dostępne

WYKRYWA

Dokładne dopasowania fragmentów tekstu. Proste zamiany synonimów i drobne przestawienia, jeśli pięciosłowne ciągi pozostają bez zmian.

NIE WYKRYWA

Każda zmiana kolejności lub sformułowania.

L2

MinHash LSH — planowane na v1.1

WYKRYWA

Wykryje przestawianie zdań i mieszanie słów w obrębie tekstu. Obecnie nie wykrywane.

NIE WYKRYWA

Prawdziwe synonimy i przekształcenia semantyczne — to zadanie dla L3.

L3

Osadzenia zdań — planowane na v1.2

WYKRYWA

Wykryje zamianę synonimów i parafrazowanie na poziomie znaczenia. Obecnie nie wykrywane.

NIE WYKRYWA

Przekształcenia tak dalekie od oryginału, że nie pozostaje żaden sygnał statystyczny.

LW

Sprawdzanie na żywo w sieci — dostępne

WYKRYWA

Źródła dodane po wykonaniu migawki korpusu.

NIE WYKRYWA

Treści za paywallem lub niezaindeksowane.

ZAKRES WYKRYWANIA

Co wykrywamy obecnie — według stopnia parafrazy.

To jest działanie wersji v1.0, nie prognoza. Przy lekkiej edycji pozostają fragmenty możliwe do dopasowania; przy gruntownym przepisaniu — nie, i żadne odciski palców tego nie wykryją. Szczegółowo opisaliśmy ten próg w naszym wpisie o rzeczywistych ograniczeniach wykrywania dosłownych zapożyczeń: /blog/the-honest-limits-of-verbatim-detection.

LEKKA
Takw v1.0 obecnie

Podmiana synonimów i drobne zmiany szyku. Wystarczająco dużo oryginalnego tekstu, by odciski palców mogły dopasować.

ORYGINAŁ

Kot siedział na macie.

PARAFRAZA

Futrzak siedział na macie.

UMIARKOWANA
Częściowow v1.0 obecnie

Przebudowane zdanie, zmienione czasowniki. Wykrywane tylko tam, gdzie pozostał niezmieniony fragment. Dopasowanie prawie identycznych tekstów (v1.1) obejmuje ten poziom.

ORYGINAŁ

Kot siedział na macie.

PARAFRAZA

Na macie kot się ułożył.

MOCNA
Niew v1.0 obecnie

Całkowita zmiana sensu, nowa struktura i słownictwo. Obecnie wynik zerowy; dopasowanie semantyczne (v1.2) obejmie ten poziom.

ORYGINAŁ

Kot siedział na macie.

PARAFRAZA

Mały ssak znajdował się na powierzchni z tkaniny.

NAJCZĘŚCIEJ PYTANE

Dziesięć pytań o wykrywanie parafrazy.

Głównie o to, gdzie wykrywanie zawodzi. Jesteśmy otwarci co do ograniczeń; to informacja dla tych, którzy podejmują decyzje na podstawie wyniku.

Czym różni się wykrywanie parafrazy od wykrywania plagiatu?
Plagiat to szersza kategoria — kopiowanie tekstu bez podania źródła. Wykrywanie parafrazy to próba wykrycia plagiatu po przekształceniu tekstu w celu ukrycia pochodzenia. Noplag łączy oba typy w jednym raporcie; moduł parafrazy uruchamia się, gdy warstwa L1 (dokładne dopasowanie) nie znajduje wyniku.
Dlaczego głęboka parafraza jest tak trudna do wykrycia?
Wykrywanie opiera się na sygnałach statystycznych — wspólnych ciągach słów, a później podobnej strukturze i znaczeniu. Lekkie zmiany pozostawiają te ciągi, więc są wykrywane. Przepisanie tekstu zdanie po zdaniu usuwa je całkowicie: pełna parafraza daje zero punktów w silniku opartym na odciskach, którym jest v1.0. To cecha metody, nie błąd, dlatego dopasowanie near-duplicate (v1.1) i semantyczne (v1.2) to osobne warstwy, a nie ustawienia. Opisaliśmy to w artykule o granicach wykrywania dosłownego: /blog/the-honest-limits-of-verbatim-detection.
Czy Noplag oferuje narzędzie do humanizacji tekstu AI?
Nie. Nie udostępniamy humanizera. Humanizer służy do omijania wykrywania — to sprzeczne z naszym celem. Stawiamy na rzetelność; wykrywamy, nie pomagamy ukrywać. Patrz wyżej — nasze stanowisko.
Jak to się ma do narzędzia parafrazującego Quillbot?
Quillbot przekształca tekst, by uniknąć wykrycia. My wykrywamy tekst przeredagowany w tym celu. To przeciwne strony tego samego problemu. Jeśli wynik Quillbota trafi do sprawdzenia, raport oznaczy 'możliwe użycie narzędzia parafrazującego', jeśli rozpoznamy charakterystyczne cechy.
Czym jest 'czterowarstwowa kaskada' i które warstwy działają?
Cztery etapy wykrywania, każdy mniej dosłowny od poprzedniego. L1 winnowing wykrywa dokładne i lekko zmienione fragmenty, a Layer W sprawdza przez wyszukiwanie w sieci — obie warstwy są dostępne w v1.0. L2 (dopasowanie near-duplicate) jest planowane na v1.1, a L3 (dopasowanie semantyczne przez osadzenia zdań) na v1.2; żadna z nich nie działa obecnie i nie ma ich jeszcze w publicznym repozytorium. Uczciwe podsumowanie: działa połowa kaskady — ta, która wykrywa lekkie przeredagowania.
A co z parafrazowaniem przez tłumaczenie zwrotne?
Tłumaczenie zwrotne (angielski → hiszpański → angielski) to jeden z najtrudniejszych typów parafrazy — znaczenie pozostaje, ale struktura jest nowa. Jeśli pozostają fragmenty oryginalnego tekstu, wykrywamy je; jeśli tekst jest całkowicie przepisany, obecnie nie wykrywamy. To cel dla warstwy semantycznej w v1.2.
Czy oznaczycie głęboką parafrazę jako 'plagiat'?
Tylko przy wystarczająco wysokim poziomie pewności. Poniżej progu pokazujemy podejrzany fragment jako 'dopasowanie o niskiej pewności' i pozostawiamy ocenę recenzentowi. Nigdy nie stwierdzamy samodzielnie, że parafraza to plagiat — raportujemy prawdopodobieństwo i uzasadnienie.
Czy mogę zobaczyć, jak Noplag ocenił fragment?
Tak. Każde dopasowanie w raporcie prowadzi do adresu źródłowego i pokazuje, która warstwa wykrywania zadziałała. Wynik można odtworzyć lokalnie przez open-source engine — patrz /open-source-plagiarism-checker.
Czy Noplag wykrywa parafrazy w innych językach niż angielski?
Wykrywanie jest skalibrowane na angielski, hiszpański, portugalski, polski i ukraiński na start; kolejne języki będą dodawane. Inne języki mają wyniki oznaczone jako 'low-resource — interpretować ze szczególną ostrożnością'.
Czy detektor parafrazy jest bezpłatny?
Tak, w darmowej wersji — 2 500 słów na sprawdzenie, bez rejestracji. W wersjach Pro i Premium limit jest wyższy; algorytm wykrywania jest ten sam na każdym poziomie.

Znajdź plagiat parafrazowany — bezpłatnie, do 2 500 słów.

Obecnie wykrywamy lekkie przeredagowanie i otwarcie przyznajemy, że głębokie przeróbki pozostaną poza naszym zasięgiem, dopóki nie wdrożymy warstw semantycznych. Sprawdź swój tekst i zobacz, co silnik faktycznie znalazł.

Wykrywaj plagiat oparty na parafrazowaniu
Wykrywacz parafrazowania — wykryj plagiat przez przeredagowanie | Noplag