Robimy to od 2014 roku.
Dwanaście lat wykrywania plagiatów. Od mieszkania w Kijowie do siedziby w San Francisco, przez akcelerator w Nowym Jorku, milion sprawdzeń i jedno celowe przebudowanie. Tak Noplag doszedł tu, gdzie jest — i dokąd zmierza.
Noplag zaczęliśmy w Kijowie w 2014 roku, bo każdy dostępny nam wtedy wykrywacz plagiatów był albo tylko dla instytucji, albo zbyt drogi, albo niejawny. Żaden nie tłumaczył, dlaczego dany fragment został oznaczony.
Stworzyliśmy darmową wersję, udostępniliśmy ją i dowiedzieliśmy się, czego ludzie faktycznie potrzebują: nie tylko wyniku, ale źródła. Nie tylko liczby, ale pełnej ścieżki audytu. Dwanaście lat i jedno przebudowanie później, to nadal jest nasz cel.
Dwanaście lat w ważnych punktach.
- 2014
Założono
Noplag wystartował jako darmowy wykrywacz plagiatów z mieszkania w Kijowie. Pierwsza wersja sprawdzała tekst przez Google, korzystając z obrotowej puli proxy. Pierwszych 100 użytkowników zdobyliśmy w trzy tygodnie.
- 2015
100 000 sprawdzeń · pierwsze pilotaże instytucjonalne
Trzy małe uczelnie z USA wdrożyły Noplag do prac studentów. Dodaliśmy obsługę plików .docx i .pdf. Odkryliśmy wtedy, że zeskanowane PDF-y wymagają OCR — na problem ten wracamy nawet po dekadzie.
- 2016
Pipeline konwersji dokumentów
Stworzyliśmy łańcuch unoconv + pdf2html, konwertujący dowolny format wejściowy do zindeksowanego HTML. Backend ze Sphinxem do wyszukiwania pełnotekstowego. Maszyna stanów — Upload → Convert → Analyse → Search → Report — opracowana wtedy, istnieje do dziś w wersji 5.0.
- 2017
Obsługa wielojęzyczna
Dodano hiszpański i portugalski. Wsparcie klienta ujawniło, że osoby piszące w ESL były częściej oznaczane — pierwsze sygnały problemu, który branża zauważy dopiero po latach.
- 2018
NY EdTech accelerator · $200K seed
Dołączyliśmy do akceleratora w Nowym Jorku dla EdTech. Pozyskaliśmy $200 000 od aniołów biznesu. Zbudowaliśmy dashboard w React 16, postęp z WebSocket, pierwsze foldery.
- 2019
1 000 000 sprawdzeń · 4 700 darmowych użytkowników
Milionowe sprawdzenie za nami. Darmowa baza urosła do 4 700. Rozpoczęliśmy pracę nad płatnościami Stripe i PayPal. Kod z tej epoki to wersja v1, z której odbudowaliśmy v5.0.
- 2020
Wstrzymanie rozwoju
Zatrzymaliśmy wydania, by zastanowić się nad dalszym kierunkiem. Pojawił się ChatGPT. Treści generowane przez AI stały się głównym tematem. Wykrywanie plagiatów bez rozpoznawania AI było niepełne. Śledziliśmy rynek, rozmawialiśmy z klientami, notowaliśmy.
- maj 2022
Siedziba przeniesiona do San Francisco
Trzy miesiące po inwazji na Ukrainę, jeden z założycieli przeniósł się do San Francisco i tam wznowił siedzibę firmy. Inżynieria dalej z Kijowa, z zespołem, który został.
- sierpień 2023
Współzałożyciele ponownie razem w San Francisco
Drugi współzałożyciel dołączył po medycznym urlopie z Sił Zbrojnych Ukrainy. Rozpoczęliśmy poważne planowanie nowej wersji.
- 2024
Start przebudowy
Podjęliśmy decyzję o rozpoczęciu od nowa, stawiając na architekturę open source. Wybraliśmy Pythona i FastAPI jako silnik, React/Next.js do warstwy interfejsu oraz Apache 2.0 jako podstawową licencję. Postawiliśmy na rozwiązanie, które można audytować, zamiast zamkniętego systemu, jako lepszą opcję na kolejną dekadę rynku.
- 2025
Silnik v1 · Layer W · chmura korpusu
Opracowano czterowarstwową kaskadę wyszukiwania (winnowing → MinHash → osadzenia → reranking) i wdrożono pierwszą warstwę, zintegrowano 3 silniki wyszukiwania, zaimportowano Common Crawl oraz 8 indeksów naukowych. MinHash (v1.1), osadzenia (v1.2) i wykrywanie treści AI oparte na Binoculars (v1.2) są w trakcie prac.
- 2026
Premiera v5.0
NA ŻYWONoplag wraca. Silnik Apache 2.0 na GitHub, wersja chmurowa na noplag.com, cztery plany cenowe, dashboard od podstaw i Noplag Database — anonimizowane odciski, które rosną z każdym sprawdzeniem. Tu jesteśmy.
Trzy zobowiązania, które zostają.
Audytowalne
Silnik wykrywający to Apache 2.0. Kod można przeczytać, sklonować, uruchomić samemu. Zaufanie nie wymaga w naszym przypadku wiary na słowo.
Uczciwe
Wykrywanie AI to wskazówka, nie wyrok. Każde trafienie pokazuje źródło. Osoby piszące w ESL mają jasny disclaimer. Nie deklarujemy dokładności, której nie możemy zmierzyć.
Twoje
Twoje dokumenty nie są używane do trenowania. Możliwość przechowywania w UE. Prawo do usunięcia jednym kliknięciem. Korpus oparty wyłącznie na zgodzie.
Mała grupa z dużym stażem.
Pierwotnie trzech inżynierów w Kijowie. Dziś siedziba w San Francisco, zespoły inżynierskie i badawcze w Ukrainie, Polsce i Hiszpanii. Do tego pełnoetatowa bibliotekarka dbająca o korpus akademicki.
Poznaj zespółChcą Państwo uczestniczyć w dalszym rozwoju?
Proszę wypróbować darmowy plan, obserwować silnik na GitHubie, dołączyć do Discorda lub napisać w sprawie wersji Enterprise. Odpowiadamy na wszystko.