Detektor AI: signál, nikoli verdikt
AI detekce dorazí brzy — je v plánu, ale zatím není spuštěna. Až bude uvedena, každý AI detektor — včetně našeho — bude mít někdy chyby. Noplag vrací kalibrovanou pravděpodobnost místo ano/ne odpovědi a zveřejní míru falešně pozitivních výsledků u ne-rodilých anglicky píšících autorů. Chystáme pokrytí pro ChatGPT, Claude, Gemini, GPT-5 a Llama. Přečtěte si, co výsledek skutečně znamená, než na něm založíte rozhodnutí — zejména pokud se rozhoduje o studentovi nebo uchazeči o práci. Detekce je jen jeden signál z více. Nikdy by neměla být jediným vstupem.
Detekční signatury pro každý hlavní LLM.
Každý model zanechává jinou statistickou stopu. Sledujeme je po jednotlivých verzích a publikujeme kalibraci podle modelu, abyste věděli, co výsledek reflektuje u LLM, který text vytvořil.
ChatGPT
Rodiny gpt-4o, o1, o3. Sledujeme změny výstupů napříč vydáními; kalibrace se přeučuje do 30 dnů od každého vydání. Report uvádí modelovou rodinu, které signál nejvíce odpovídá.
Claude
Verze Sonnet, Opus, Haiku v řadách 3.x a 4.x. Detekční signál se liší podle režimu (uvažování vs. rychlý); v reportu je uvedena kalibrace pro každý režim.
Gemini
1.5 Pro, 2.0 Flash, 2.5 Pro. Vícejazyčný signál je slabší pro ne-anglické texty; v reportu je to označeno jako 'nízká jistota' místo zamlčení.
GPT-5
Srpnová verze OpenAI z roku 2025. Behaviourální signatura se liší od gpt-4o; přeučujeme na referenčních výstupech uváděných v model card do 30 dnů.
Llama
Rodiny 3, 3.1, 3.3. Samohostované varianty jsou obtížnější — doladění mění signaturu. Report vrací 'pravděpodobně vygenerováno LLM, rodina Llama' místo konkrétní verze.
Každý AI detektor příliš často označí ne-rodilé anglické autory. Toto děláme my.
Liang a kol. (Stanford, 2023) naměřili 61% falešně pozitivní míru u TOEFL esejí — šestkrát více než u rodilých autorů. Každý detektor. I ten náš, než jsme to opravili.
Stanfordská studie
Liang a kol. (2023) testovali všechny komerční AI detektory na TOEFL esejích ne-rodilých mluvčích. Referenční detektor označil 61 % jako AI-generované — šestinásobek oproti rodilým autorům. Stejné texty, stejný úkol.
Co jsme překalibrovali
Přeučili jsme klasifikátor bez ESL stylových znaků — jednotná délka vět, jednoduchá slovní zásoba, méně idiomů nejsou brány jako AI signály. Pouze na strukturních znacích. Hodnotíme jen strukturu, ne styl.
Zbytková chybovost
Po opravě: zdokumentované intervaly spolehlivosti podle jazyka místo jednoho souhrnného čísla. Tabulky pro jednotlivé jazyky zveřejníme, jakmile funkce projde vyhodnocením — přesně to, co by požadoval institucionální audit.
Kdy ignorovat výsledek
U ESL autora v rozmezí 20–80 % berte výsledek jen jako doporučení. V reportu je explicitně uvedeno 'nízká jistota — interpretujte opatrně', aby bylo zřejmé, kdy nejednat.
Co stále míjíme
Hybridní psaní — návrh LLM, finální editace rodilým mluvčím — je těžší než čisté případy. Report označí 'smíšený signál, pravděpodobně hybrid', místo domněnky; část chyb zůstává zde.
Kde měříme
Veřejné sady esejí TOEFL, akademické práce Pan-Hispano a vícejazyčné texty hodnocené podle CEFR. Stejná data jako Liang et al., navíc 8 novějších korpusů z let 2024–2026. Odkazy zveřejníme spolu s metodikou při uvedení funkce.
Pravděpodobnost, ne výrok.
Výsledek je pravděpodobnost mezi 0 % a 100 %. Nad 80 %: vysoká jistota AI-generovaného textu. Pod 20 %: vysoká jistota lidského autora. Rozmezí 20–80 % použijte jako jeden vstup, ne jako důkaz. Detekce má být začátek dialogu, ne jeho konec.
Vysoká pravděpodobnost, že text napsal člověk. Míru falešně pozitivních výsledků pro toto pásmo zveřejníme podle jazyka po vyhodnocení funkce.
Model si není jistý. Berte výsledek jen jako jeden z více vstupů — např. předchozí ukázky textu, předchozí verze, výstupy ze školního psaní. Nejednejte jen podle tohoto rozmezí.
Vysoká jistota, že text vytvořil velký jazykový model. Ani tak to není výrok. Kombinujte s kontextem (zadání, historie prohlížení, ústní obhajoba) před rozhodnutím.
- 5Rodiny LLM zaměřené při spuštění
- 61 %Stanfordská falešně pozitivní míra, 2023
- 30dplánovaná frekvence přeškolení po každém vydání modelu
- v1.2plánované vydání detekce AI
- 2024začátek detekce R&D
Jsme na straně integrity. Není zde nástroj pro obcházení detekce.
Humanizer je nástroj pro obcházení AI detekce — přepíše výstup LLM, aby snížil detekční skóre. Můžeme ho vytvořit. Neděláme to. Cílem tohoto produktu je odhalovat použití AI, ne jeho skrývání. Pokud má být detekce užitečná, ti kdo provozují detektory a kdo vyvíjejí humanizery nesmí být stejní dodavatelé. Vybrali jsme si jasnou stranu. Pokud zde mluvíme o humanizerech, je to proto, abyste věděli, že existují a že je někdo mohl použít na text, který kontrolujete — ne aby vám je nabízíme.
Přečtěte si celý postojJak si vedeme proti GPTZero, Originality.ai a Winston.
Cílí na vzdělávání, nemá plagiátorství, kalibrace je neprůhledná. Jen AI detekce; pokud potřebujete i plagiátorství v jednom reportu, používáte dva nástroje.
Detekce + plagiátorství + open-source engine. Kalibrační data pro jednotlivé modely jsou zveřejněna. Stejná zpráva, stejný dodavatel, kompletně auditovatelné.
'97% přesnost' v marketingu. Nezveřejněná míra falešně pozitivních. Kalibrace pouze v angličtině. Uzavřený kód — nelze auditovat skóre.
Otevřeně přiznáváme zkreslení vůči ESL (citujeme konkrétně Liang 2023). Kalibrace pro více jazyků. Engine je open source; metodiku zveřejníme spolu s funkcí.
Silný pro detekci ChatGPT. Slabší signál pro Claude a Gemini. Nákladné při velkém objemu; ceny odstupňované po 10k slovech/měsíc.
Pokrytí každé hlavní modelové rodiny s obdobnou kalibrační péčí. Taryfní paušální plány po úroveň Pro. Možnost samohostování pro zákazníky s compliance.
Dvanáct otázek, upřímné odpovědi.
Nevíme-li odpověď, řekneme to. Se změnou kalibrace seznam aktualizujeme.
- Je detekce AI přesná?
- Upřímná odpověď: žádný detektor není spolehlivý u textů pod ~200 slov a každý má falešně pozitivní výsledky, které se liší podle stylu psaní, jazyka a použitého LLM. Noplag se zavazuje zveřejnit kalibrační data, abyste věděli, co znamená „přesnost“ pro váš konkrétní případ; data budou zveřejněna spolu s funkcí.
- Označí Noplag moje ne-rodilé anglické psaní za AI-generované?
- Může — a jsme v tom upřímní. Liang a kol. (Stanford 2023) prokázali, že každý detektor přehnaně označuje ESL autory. Naše opatření omezují falešně pozitivní pro známé ESL vzory; zveřejňujeme chybovost zbytků. Pokud je signál nejasný, report to uvede.
- Jaké AI modely bude Noplag detekovat?
- Při startu detekujeme ChatGPT (gpt-4o, o1, o3), Claude (Sonnet / Opus / Haiku, 3.x a 4.x), Gemini (1.5 / 2.0 / 2.5), GPT-5 a Llama 3.x. Detekce bude spuštěna brzy; kvalita detekce se liší podle modelu a report uvede, kterému signálu skóre odpovídá.
- Jak se liší tento detektor od GPTZero nebo Originality.ai?
- AI detekci nabízíme společně s kontrolou plagiátorství a engine poskytujeme jako open source. GPTZero slouží pouze k detekci. Originality.ai je uzavřený software a data o zkreslení vůči uživatelům s angličtinou jako druhým jazykem nezveřejňuje. Podrobné srovnání najdete na /vs-gptzero a /vs-originality-ai.
- Mohou studenti detektor obejít humanizerem?
- Ano — humanizery existují, to si nebudeme zastírat. Silné přepisování po generování LLM snižuje detekční signál. Nevyvíjíme humanizer (je to proti našemu poslání). Detekci AI berte jen jako jeden vstup, nikdy jako verdikt.
- Co zde znamená 'falešně pozitivní' výsledek?
- Lidský text vyhodnocený jako AI-generovaný. Míru tohoto jevu změříme a zveřejníme podle jazyka a stylu psaní. U žádného detektoru není nulová — považovat vysoké skóre za důkaz místo signálu k prověření je právě ten chybný postup, před kterým tato stránka varuje.
- Nabízíte 'detekci s 99% přesností'?
- Ne. Každý, kdo tvrdí přesnost nad ~85 % napříč styly, jazyky a LLM, zkresluje, co matematika umožňuje. Skutečný interval spolehlivosti zveřejníme podle jazyka po vyhodnocení funkce. Nenabízíme jistotu.
- Je detekce AI zdarma?
- Detekce AI bude spuštěna brzy. Na bezplatné úrovni bude zdarma — stejný limit 2 500 slov jako pro kontrolu plagiátů. Placené úrovně navyšují limit; AI detekce nebude samostatně zpoplatněná.
- Jak je pokrytí modelů aktuální?
- Detekci přeučujeme do 30 dnů po vydání nových LLM. Pokud model zatím není v naší kalibraci, report uvede 'pravděpodobně LLM, model neznámý' místo domněnky rodiny.
- Zvládáte vícejazyčnou AI detekci?
- Angličtina, španělština, francouzština, němčina a portugalština mají ověřenou kalibraci — nejvyšší síla v angličtině. Ostatní jazyky vrací výsledek označený 'nízko-zdrojové — interpretujte s rezervou.' Report popíše, jaké kalibraci text odpovídá.
- Lze AI detekci integrovat přes API?
- Brzy. AI detekce je v plánu; po spuštění vrátí endpoint /v1/checks jak plagiátorství, tak skóre AI detekce. Viz /plagiarism-checker-api a /docs/api.
- Co když s výsledkem nesouhlasím?
- Dejte nám vědět. Záznamy korigujeme, přeučujeme do 30 dnů po každém vydání modelu a zveřejníme změny chování modelu mezi verzemi. Detekce není dokonalá; je pro nás důležité vědět, kdy se mýlí, než předstírat opak.
AI detekce — již brzy zdarma do 2 500 slov.
Kalibrační data, míra falešně pozitivních a signatury podle modelu budou zveřejněny. Poznejte, co je za skóre, než podle něj něco uděláte.
Dejte mi vědět, až to spustíte