AI-tuvastus – signaal, mitte lõplik otsus
AI tuvastus tuleb varsti — see on plaanis, pole veel kasutusel. Kui see välja tuleb, on iga detektor — kaasa arvatud meie oma — vahel ekslik. Noplag annab kalibreeritud tõenäosusskoori, mitte jah/ei vastust, ja avaldab valepositiivse määra mitte-emakeelsete inglise keele kirjutajate kohta. Arendame katvust ChatGPT, Claude, Gemini, GPT-5 ja Llama jaoks. Vaadake, mida skoor tegelikult tähendab, enne kui selle põhjal midagi otsustate — eriti õppurid või tööle kandideerijad. Tuvastus on üks signaal paljudest. Ärge toetuge sellele ainuna.
Tuvastussignatuurid igale põhilisele LLM-ile.
Igal mudelil on erinev statistiline signatuur. Jälgime neid versiooniti ja avaldame mudelipõhise kalibreerimise, et teaksite, mida skoor tähendab selle LLM-i jaoks, mis antud teksti kirjutas.
ChatGPT
gpt-4o, o1, o3 perekonnad. Jälgime väljundi nihet iga versiooni lõikes; mudelipõhine kalibreerimine uuendatakse 30 päeva jooksul pärast igat väljalaset. Raportis on välja toodud, millise mudeliperekonna signaaliga kõige paremini kattub.
Claude
Sonnet, Opus, Haiku tasemed 3.x ja 4.x mudelitel. Tuvastussignaali tugevus sõltub režiimist (mõtlemine vs. kiirus); kalibreering on igas raportis režiimiti välja toodud.
Gemini
1.5 Pro, 2.0 Flash, 2.5 Pro. Mitmekeelne signaal on mitte-ingliskeelse teksti puhul nõrgem; raportis märgitakse see kui 'madal ressursi kindlus' — ei varja.
GPT-5
OpenAI 2025. aasta augusti väljalase. Käitumissignaatur erineb gpt-4o-st; ümberõpe mudelikaardi referentsväljastuste vastu toimub 30 päeva jooksul pärast väljalaset.
Llama
3, 3.1, 3.3 perekond. Isehostitavad variandid on keerulisemad — peenhäälestus muudab signatuuri. Raportis hinnatakse 'tõenäoliselt LLM-i genereeritud, perekond Llama', mitte täpset versiooni.
Iga AI detektor märgib üle mitte-emakeelsed inglise keele kirjutajad. Meie meetod:
Liang jt. (Stanford, 2023) mõõtsid TOEFL kirjanditel 61% valepositiivset määra — kuus korda rohkem kui emakeelsete kirjutajate puhul. Iga detektor. Ka meie oma enne parandusmeetmeid.
Stanfordi artikkel
Liang jt. (2023) testisid iga ärilisel eesmärgil loodud AI detektorit TOEFL esseedel, mille kirjutasid mitte-emakeelsed inglise keele kasutajad. Tüüpiline detektor hindas 61% tekstidest AI poolt genereerituks — kuus korda sagedamini kui emakeelsete puhul. Sama tekst, sama ülesanne.
Meie ümberkalibreerimine
Koolitasime klassifitseerija ümber, eemaldades ESL-stiili tunnused — ühtlase lausepikkuse, lihtsama sõnavara, vähem idioome ei loeta AI-signaaliks. Ainult stiilivabad tunnused. Ennustame struktuuri, mitte keelelise 'viimistluse' põhjal.
Jäänud veamäär
Pärast parandust: iga keele kohta dokumenteeritud usaldusvahemik, mitte üks üldine number. Keelepõhised tabelid avaldatakse, kui funktsioon on hindamise läbinud — täpselt see, mida institutsionaalne audit nõuaks.
Millal mitte kasutada
Kui hindate mitte-emakeelset kirjutajat ning skoor jääb 20–80% vahemikku, kohtlege seda ainult nõuandena. Raportis tuuakse välja 'madal kindlus — tõlgendage ettevaatusega', et kasutaja teaks, millal mitte tegutseda.
Mida me ikka veel ei tuvasta
Hübriidkirjutamine — LLM-i mustand, mida parandab emakeelne toimetaja — on raskem kui kumbki eraldi. Raport märgib 'segalise signaali, tõenäoliselt hübriid', ei arva juhuslikult; osa residueerivatest eksimustest ongi siin.
Millest me mõõdame
Avalikud TOEFL esseekogud, Pan-Hispano akadeemilised tööd ja CEFR-tasemega mitmekeelsed kirjutised. Sama andmestik, mida kasutasid ka Liang jt, lisaks 8 uut korpust kogutud aastatel 2024–2026. Viited avaldatakse koos metoodikaga, kui funktsioon välja tuleb.
Tõenäosus, mitte otsus.
Skoor on tõenäosus vahemikus 0% kuni 100%. Üle 80%: väga tõenäoliselt AI genereeritud. Alla 20%: väga tõenäoliselt inimeste kirjutatud. 20–80% on vahemik, kus kohtlete seda ühe sisendina paljude seas — mitte tõendina. Kasutage tuvastust arutelu alustamiseks, mitte lõpetamiseks.
Suur tõenäosus, et teksti autor on inimene. Selle vahemiku valepositiivsete määr avaldatakse iga keele kohta, kui funktsioon on hindamise läbinud.
Mudel ei ole kindel. Võtke skoori kui üht sisendit — hiljutised kirjutised, eelnevad mustandid, töö klassis. Ärge tegutsege ainuüksi selle vahemiku põhjal.
Kindel, et tekst on pärit suurelt keelemudelilt. Ikkagi mitte otsus. Lisage kontekst (põhjus, brausimisajalugu, suuline kaitse) enne ükskõik millist otsust.
- 5Käivitamisel sihitud LLM-i perekonnad
- 61%ESL valepositiivne määr, Stanford '23
- 30dplaanitud ümberõppe sagedus pärast iga mudeli väljalaset
- v1.2AI-sisu tuvastuse väljalaske sihtkuupäev
- 2024tuvastuse arendus algab
Meie valik on ausus. Me ei paku tööriista tuvastuse petmiseks.
Humaniseerija on tööriist AI tuvastuse vältimiseks — see kirjutab LLM väljundi ringi, et madaldada tuvastusskoori. Me suudaks seda teha. Me ei tee. Selle toote mõte on tehisintellekti kasutus välja tuua, mitte selle peitmist soodustada. Kui tuvastus peab olema kasulik, ei tohi pisendajad ja tuvastajad olla sama pakkuja tööriistad. Meie oleme valinud pooluse. Kui selles tootes mainime humaniseerijaid, siis ainult selleks, et öelda, et need eksisteerivad ja võivad olla kasutusel juba enne teie teksti kontrollimist — mitte selleks, et neid pakkuda.
Lugege täielikku seisukohavõttuKuidas me võrdleme: GPTZero, Originality.ai ja Winston.
Hariduskeskne, pole plagiaadituvastust, läbipaistmatu kalibreering. Ainult AI tuvastus — kui vajate ka plagiaaditõendit ühes raportis, vajate kahte tööriista.
Tuvastus + plagiaat + avatud lähtekoodiga mootor. Iga mudeli kalibreerimisandmed avalikud. Sama aruanne, sama teenusepakkuja, kontrollitav algusest lõpuni.
'97% täpsus' turundus. Valepositiivse määra andmed avaldamata. Ainult ingliskeelne kalibreering. Suletud lähtekood — skoori arvutamist ise ei saa auditeerida.
Ausalt ESL-i kallutatuse kohta (viitame nimeliselt Liang 2023-le). Mitmekeelne kalibreerimine. Avatud lähtekoodiga mootor; metoodika avaldatakse koos funktsiooniga.
Tugev ChatGPT tuvastuses. Nõrgem signaal Claude ja Gemini puhul. Kallis suurte mahtude korral; hind piiratud pärast 10k sõna/kuu.
Katab kõik põhilised mudeliperekonnad sama kalibreerimise vaevaga. Püsitasu Pro-tasandini. Isehostitav variant nõuetele vastavatele ostjatele.
Kaksteist küsimust, ausad vastused.
Kui me ei tea vastust, ütlebki vastus nii. Uuendame seda loendit kalibreeringu muutudes.
- Kas AI tuvastus on täpne?
- Aus vastus: ükski tuvastaja ei ole usaldusväärne alla ~200-sõnalise teksti puhul ning kõigil tuvastajatel on valepositiivsete määrad, mis sõltuvad kirjutamisstiilist, keelest ja sellest, milline LLM teksti lõi. Noplag kohustub avaldama oma kalibreerimisandmed, et te teaksite, mida „täpsus” teie kasutusjuhtumi jaoks tähendab; need avaldatakse koos funktsiooniga.
- Kas Noplag märgib minu mitte-emakeelse inglise kirjutise AI-ks?
- Võib juhtuda — ja oleme selles ausad. Liang jt. (Stanford 2023) näitasid, et iga AI detektor ülehindab ESL kirjutajaid. Meie kaitsed piiravad teadaolevate ESL mustrite valepositiivseid, avaldame jäägimäära. Kui signaal on ebakindel, näitab raport seda.
- Milliseid AI mudeleid Noplag tuvastab?
- Tööriista lansseerimisel hõlmab AI tuvastus ChatGPT (gpt-4o, o1, o3), Claude (Sonnet / Opus / Haiku, 3.x ja 4.x), Gemini (1.5 / 2.0 / 2.5), GPT-5 ja Llama 3.x. Tuvastus on varsti tulemas; tuvastuse kvaliteet sõltub mudelist, ning raport ütleb, millise mudeli signatuuriga skoor kattub.
- Kuidas erineb see GPTZero või Originality.ai-st?
- Pakume AI tuvastust koos plagiaadikontrolliga ning tarnime mootori avatud lähtekoodina. GPTZero tuvastab ainult AI-d. Originality.ai on suletud lähtekoodiga ja ei avalda ESL-i kallutatuse andmeid. Reavaheliste võrdluste jaoks vaata /vs-gptzero ja /vs-originality-ai.
- Kas üliõpilased saavad seda detektorit humaniseerijaga petta?
- Jah — humaniseerijad on olemas, see tuleb ausalt öelda. Põhjalik ümberkirjutamine pärast LLM-i mustandit vähendab tuvastussignaali. Me ise humaniseerijat ei paku (see on meie eesmärgile vastupidine). AI tuvastust tuleb võtta ühe sisendina, mitte lõpliku vastusena.
- Mida tähendab 'vale positiivne' siin?
- Inimese kirjutatud tekst hinnatud AI-looduks. Mõõdame ja avaldame selle määra iga keele ja kirjutamisstiili klastrite lõikes. Ühelgi tuvastajal pole see null — kõrge skoori pidamine tõendiks, mitte uurimist vajavaks märgiks, on väärkasutus, mille vältimiseks see leht loodud on.
- Kas te müüte '99% täpsusega tuvastust'?
- Ei. Igaüks, kes väidab üle ~85% püsivat täpsust erinevate kirjutamisstiilide, keelte ja LLM-ide lõikes, esitab matemaatiliselt võimatut. Avaldame tegeliku usaldusvahemiku iga keele kohta, kui funktsioon on hindamise läbinud. Me ei müü kindlust.
- Kas AI tuvastus on tasuta?
- AI tuvastus on varsti saadaval. Lansseerimisel on see tasuta tasuta taseme kasutajale — sama 2500 sõna piir plagiaadituvastusega. Tasulised astmed tõstavad limiiti; AI tuvastust ei panda kunagi eraldi tasulise lisana müüki.
- Kui värske on mudeli katvus?
- Õpetame tuvastuse vastavuses uute LLM-idega 30 päeva jooksul. Kui mudeli kalibreering puudub, näitab raport 'tõenäoliselt LLM-i loodud, mudel teadmata' — ei arva juhuslikult perekonda.
- Kas toetate mitmekeelset AI tuvastust?
- Inglise, hispaania, prantsuse, saksa ja portugali keeles on valideeritud kalibreering — tugevaim signaal on inglise keeles. Teistes keeltes saadakse tulemus sildi all 'madala ressursiga — tõlgendage eriti ettevaatlikult'. Raportis öeldakse, millise kalibreeringu tase teie tekstile kehtib.
- Kas saan AI tuvastuse API kaudu integreerida?
- Varsti. AI tuvastus on plaanis; lansseerimisel tagastab /v1/checks nii plagiaadi- kui AI-tuvastuse skoorid. Vt /plagiarism-checker-api ja /docs/api.
- Mis saab, kui ma pole skooriga nõus?
- Andke teada. Logime parandused, õpetame uued mudelid uuesti iga väljalaske järel ning avaldame mudeli käitumise muutuse verisooniti. Tuvastus pole täiuslik; parem, kui annate teada, kui see eksib, mitte ei teeskle, et kõik töötab veatult.
AI tuvastus — varsti saadaval, tasuta kuni 2500 sõnani.
Kalibreerimisandmed, valepositiivsed määrad ja mudelipõhised signatuurid avalikustatakse. Vaadake, mis on skoori taga, enne kui selle järgi otsustate.
Teavitage mind, kui see on saadaval