ПОЗИЦІЯВиявлення — не генерація.

Детектор перефразування — знаходить замасковане копіювання

Детектор перефразування знаходить текст, який був переформульований для приховування джерела. Noplag вже зараз виявляє легкі випадки: якщо залишаються незмінними фрагменти з п’яти слів, такі збіги фіксуються, тому підбір синонімів і незначна перестановка слів знаходяться через відбитки winnowing і перевіряються пошуком у вебі. Повне переписування речень — це інша задача, яку ми поки що не вирішуємо. Для цього потрібні механізми пошуку майже ідентичних текстів (v1.1) і семантичного зіставлення (v1.2) — вони з’являться після проходження публічної оцінки.

0 / 1,500 words
Виявляє легке перефразуванняВідкритий програмний рушійЧітко про те, що не знаходить
НАША ПОЗИЦІЯ

Ми виявляємо. Ми не допомагаємо обходити.

Гуманайзер — це інструмент, який переписує текст, створений AI або людиною, спеціально для обходу виявлення. Ми могли б зробити такий інструмент. Але не робимо. Мета цього продукту — виявляти нецитоване копіювання, а не допомагати його приховувати. Якщо виявлення має бути корисним, ті, хто створює детектори, і ті, хто створює гуманайзери, не можуть бути одним і тим самим постачальником. Ми визначилися зі своєю роллю.

Якщо ми згадуємо гуманайзери у звіті, це для того, щоб повідомити про їхнє існування і можливе використання до перевірки вашого тексту — не для того, щоб їх рекламувати.

ІНСТРУМЕНТИ, З ЯКИМИ МИ НЕ КОНКУРУЄМО
QuillbotUndetectableStealthGPTHumbotAIHumanizeWalter Writes
ЯК ПРАЦЮЄ СЕМАНТИЧНЕ ВИЯВЛЕННЯ

Чотири рівні. Два вже доступні, ще два в розробці.

Каскад звужується від точного співпадіння через майже ідентичні до семантичної еквівалентності, а потім перевіряє відкриту мережу. Два з цих рівнів доступні у v1.0; два, що відповідають за виявлення справжнього перефразування, ще розробляються, і ми чесно про це повідомляємо.

L1

Winnowing fingerprints — вже доступно

ВИЯВЛЯЄ

Точні співпадіння підрядків. Легкі заміни синонімів і незначне переставлення, якщо залишаються послідовності з п’яти слів.

НЕ ВИЯВЛЯЄ

Будь-яке переставлення чи перефразування.

L2

MinHash LSH — у планах на v1.1

ВИЯВЛЯЄ

Буде виявляти переставлення речень і перестановку слів. Наразі не визначається.

НЕ ВИЯВЛЯЄ

Справжні синоніми та семантичні переробки — для цього призначений L3.

L3

Sentence embeddings — у планах на v1.2

ВИЯВЛЯЄ

Буде виявляти заміну синонімів і семантичне перефразування. Наразі не визначається.

НЕ ВИЯВЛЯЄ

Переробки, які настільки відрізняються від джерела, що статистичний сигнал зникає.

LW

Перевірка в реальному часі через веб — доступно

ВИЯВЛЯЄ

Джерела, додані після знімка корпусу.

НЕ ВИЯВЛЯЄ

Контент за платним доступом або неіндексований.

ОХОПЛЕННЯ ВИЯВЛЕННЯ

Що виявляється зараз — залежно від ступеня перефразування.

Це поведінка v1.0, не прогноз. Легка редакція залишає фрагменти, які ще можна зіставити; повне переписування — ні, і жоден метод відбитків цього не відновить. Ми детально описали, де саме проходить ця межа, у нашій статті про чесні обмеження дослівного виявлення: /blog/the-honest-limits-of-verbatim-detection.

ЛЕГКЕ
Таку v1.0 зараз

Заміна синонімів і незначна перестановка. Достатньо оригінального формулювання, щоб відбитки збігалися.

ОРИГІНАЛ

Кіт сидів на килимку.

ПЕРЕФРАЗОВАНО

Кішка сиділа на килимку.

СЕРЕДНЄ
Частковоу v1.0 зараз

Перебудова речення, зміна дієслів. Виявляється лише там, де залишився недоторканий фрагмент. Пошук майже ідентичних (v1.1) орієнтований на цей рівень.

ОРИГІНАЛ

Кіт сидів на килимку.

ПЕРЕФРАЗОВАНО

На килимку влаштувався кіт.

СИЛЬНЕ
Ніу v1.0 зараз

Повне семантичне переписування, нова структура й лексика. Зараз дає нульовий результат; семантичне зіставлення (v1.2) орієнтоване на цей рівень.

ОРИГІНАЛ

Кіт сидів на килимку.

ПЕРЕФРАЗОВАНО

Маленька тварина розмістилася на тканинній поверхні.

ПОШИРЕНІ ЗАПИТАННЯ

Десять питань про виявлення перефразування.

Переважно про те, де виявлення не спрацьовує. Ми прямо вказуємо на межі — це важливо для тих, хто приймає рішення на основі результату.

Чим відрізняється виявлення перефразування від виявлення плагіату?
Плагіат — ширше поняття: це копіювання тексту без посилання на джерело. Виявлення перефразування — це окрема задача: знайти плагіат, коли текст переписали, щоб приховати джерело. Noplag виконує обидва завдання в одному звіті; модуль перефразування запускається, коли рівень L1 (точний збіг) не спрацьовує.
Чому складно виявити глибоке перефразування?
Виявлення працює через пошук статистичних ознак — спільних послідовностей слів, а далі — спільної структури й змісту. Легке редагування залишає ці послідовності, тому його знаходять. Якщо переписати текст по реченнях, спільні фрагменти зникають: якісне перефразування дає нульовий результат у системі відбитків, якою є v1.0. Це особливість методу, а не помилка, і саме тому пошук майже ідентичних (v1.1) та семантичних (v1.2) збігів — це окремі рівні, а не налаштування. Детальніше — у нашій статті про межі точного виявлення: /blog/the-honest-limits-of-verbatim-detection.
Чи є у Noplag інструмент для «олюднення» AI-тексту?
Ні. Ми не пропонуємо humanizer. Завдання humanizer — обійти виявлення, це суперечить нашій меті. Ми працюємо на стороні доброчесності: виявляємо, а не допомагаємо приховувати. Див. позицію вище.
Чим це відрізняється від інструмента перефразування Quillbot?
Quillbot переписує текст, щоб обійти виявлення. Ми шукаємо тексти, переписані для уникнення виявлення. Ми на протилежних сторонах однієї задачі. Якщо результат Quillbot потрапить у перевірку, у звіті з’явиться позначка «можливе використання інструмента перефразування», якщо ми знайдемо відповідні ознаки.
Що таке «каскад із чотирьох рівнів» і які з них уже працюють?
Чотири етапи виявлення, кожен менш буквальний за попередній. L1 знаходить точні й злегка змінені збіги, Layer W перевіряє через пошук у вебі — обидва працюють у v1.0. L2 (пошук майже ідентичних) у планах на v1.1, L3 (семантичний пошук через sentence embeddings) — на v1.2; обидва ще не запущені й не у відкритому репозиторії. Чесно: працює половина каскаду, і це та частина, що ловить легке перефразування.
А як щодо перефразування через зворотний переклад?
Зворотний переклад (англійська → іспанська → англійська) — один із найскладніших типів перефразування: зміст зберігається, структура змінюється. Якщо залишаються фрагменти оригіналу — ми їх знаходимо; якщо текст переписано повністю — зараз не виявляємо. Це задача для семантичного рівня у v1.2.
Чи будете ви позначати глибоке перефразування як «плагіат»?
Тільки якщо впевненість достатньо висока. Якщо нижче порогу — показуємо підозрілий фрагмент із позначкою «збіг із низькою впевненістю» і залишаємо рішення рецензенту. Ми ніколи не оголошуємо перефразований плагіат однозначно — вказуємо ймовірність і пояснення.
Чи можна побачити, як Noplag оцінив фрагмент?
Так. Кожен збіг у звіті містить посилання на джерело й показує, який рівень спрацював. Ви можете відтворити результат офлайн через open-source engine — див. /open-source-plagiarism-checker.
Чи працює Noplag для перефразування неанглійською?
Виявлення налаштоване для англійської, іспанської, португальської, польської та української на старті, інші мови додаються поступово. Для інших мов результати позначаються як «low-resource — інтерпретувати з обережністю».
Чи безкоштовний детектор перефразування?
Так, у безкоштовному тарифі — до 2 500 слів за перевірку, без реєстрації. У Pro та Premium ліміти вищі; алгоритм виявлення однаковий для всіх тарифів.

Знаходьте перефразований плагіат — безкоштовно, до 2 500 слів.

Ми вже виявляємо легке перефразування і прямо зазначаємо: глибоке переписування залишиться поза межами виявлення, доки не з’являться семантичні модулі. Запустіть перевірку власного тексту й ознайомтеся з реальними результатами роботи рушія.

Виявляйте плагіат із перефразуванням
Детектор перефразування — виявлення переформульованого плагіату | Noplag