Verificare plagiat pentru jurnaliști pre-publicare
Autoverificați materialul înainte să ajungă la editor. Detectează preluări parafrazate și text din comunicate; detectarea materialului generat de AI apare în curând. În plus: urmăriți unde vă este republicat byline-ul. Gratuit până la 2.500 de cuvinte. API REST pentru integrare în redacție dacă depuneți prin CMS.
Patru fluxuri pentru reporteri. O singură autoverificare.
Depuneri zilnice la termen
Editorul vede materialul imediat după. Verificați-l mai întâi.
- Autoverificare de 30 de secunde pentru un material de 900 de cuvinte
- Text standard din comunicat marcat automat
- Suprapunere wire scoasă la suprafață înainte de publicare
Texte lungi cu cercetare reutilizată
Feature-uri de 5.000 cuvinte din interviuri și materiale proprii anterioare.
- Auto-citare: textele proprii marcate SELF-CITE
- Clasificare material citat (atribuit vs parafrază)
- Sensibil la embargo: verifică doar față de materiale ne-embargate
Luni de documentare într-o singură piesă
Detectează acolo unde parafrazarea fără atribuție poate apărea accidental.
- Verificare atribuire sursă pe fiecare paragraf
- Scanare documente comparativ cu folderul personal de surse
- Instantaneu DMCA când exclusivitatea e republicată
Depuneri la mai multe publicații, fără QA intern
Sunteți propriul editor; autoverificarea e singura verificare înainte de editor.
- Verificare de pe telefon (din teren)
- Autoreciclare cross-publicație marcată, cu allowlist
- Gratuit pentru un material obișnuit de 2.500 de cuvinte
Trei pași înainte de butonul de trimitere.
Integrat în fluxul redacției prin API sau direct din dashboard. Același motor. Același raport. Acel interval de 47 de secunde.
01 · Autoverificați draftul
Pastați sau încărcați draftul. Adăugați allowlist pentru byline (texte proprii, liste de sindicare wire). Motorul separă parafrazarea accidentală a propriilor texte (legitim) față de parafrazări ale conținutului altora (problemă).
02 · Verificați sursele
Raportul afișează fiecare secvență detectată cu URL sursă, status canonical-tag, dată snapshot. Textul de comunicat este marcat automat REPRINT. Unele publicații acceptă citare directă cu atribuire; altele impun rescriere. Clasificare AI pe paragraf, calibrată pentru ESL, apare în curând.
03 · Decideți înainte de a depune
Verificați clasificarea: citatele corect atribuite (excluse din scor), parafrazarea cu sursă (scor mic), parafrazări fără sursă (de corectat). După lansarea detecției AI, paragrafele implicate vor avea nevoie de mențiune sau rescriere conform politicii publicației. După ce este clar, depuneți. Raportul se atașează la material ca dovadă audit.
Șase lucruri de verificat la fiecare paragraf înainte de depunere.
Fiecare categorie este afișată lângă secvența detectată. Marcați automat unde publicația cere atribuire. Pragul: „ar accepta desk-ul de standarde?”
01 · CITAT DIRECT
Ghilimele și atribuție vorbitor în aceeași frază. Considerat citat, nu intră în scorul de similaritate. Detectat cu folderul de transcrieri încărcate, dacă interviurile au fost folosite ca surse.
02 · COMUNICAT PRESĂ
Text identic cu un comunicat public. Marcat REPRINT. Unele publicații acceptă citatul cu atribuire; altele (majoritatea ziarelor din SUA) cer rescriere. Configurați la nivel outlet din Settings.
03 · WIRE COPY
Comparare cu fluxuri AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA (abonament Premium cu corpus wire). De obicei, textele wire pot fi rescrise legal sub licență; motorul arată sursa wire astfel încât să știți ce este licențiat și ce este doar preluat.
04 · EMBARGO
Adăugați materiale sub embargo într-un scope temporar. Motor sensibil la embargo: găsește potriviri pe conținut embargat, marcate ca EMBARGO-OK până la dată, apoi revine la clasificare normală. Relevant pentru jurnalism științific.
05 · AI-GENERAT (ÎN CURÂND)
Probabilitate AI pe paragraf, calibrată ESL, pe roadmap. Făcut pentru verificarea colaboratorilor externi. Materialele AI sunt suficient de frecvente încât să fie detectate înainte de desk-ul de standarde. Metodologie deschisă (Binoculars, Hans et al. 2024).
06 · PROPRIUL ANTERIOR
Allowlist byline: texte proprii publicate, URL portofoliu, Substack, arhiva Medium. Auto-reciclare marcată SELF-CITE — uzual în feature-uri când construiți pe o poveste anterioară. Nu crește scorul de similaritate; tot apare ca flag de revizuit.
Ce vedeți după 47 de secunde pe un material de 1.500 de cuvinte.
Clasificare pe paragraf cu URL sursă, status atribuire și click direct spre secvența marcată. Defendabil la desk-ul de standarde; reproductibil pe commit-ul motorului prezent în raport.
Trei acțiuni când exclusivitatea apare cu alt semnătură.
Setați byline-ul ca interogare urmărită
Pastați articolul publicat (sau lista) în lista de monitorizare. Scanare zilnică găsește orice domeniu non-allowlisted care vă republică materiale — copii, rescrieri, variante AI. Notificarea include URL-ul identificat, paragrafele și timestamp-ul scrape-ului.
Instantaneu DMCA, datat și hash-uit
Orice scraping marcat vine cu snapshot HTML, dată a scraping-ului, hash pentru contra-manipulare. Împreună cu timestamp-ul byline-ului original (din CMS, tweet, captură Wayback Machine) obțineți lanțul de prioritate.
Byline pe syndicare legitimă
Dacă syndicați pe Medium, LinkedIn, Substack sau parteneri, motorul verifică dacă tag-ul canonical trimite la materialul original. ORIGIN = SEO la dvs.; LEAK = syndicare rupe clasamentul. Problemă comună la LinkedIn: deseori lipsesc canonical tags.
Două lucruri de care au nevoie jurnaliștii și pe care instrumentele academice nu le tratează.
Majoritatea programelor de plagiat nu sunt gândite pentru redacții. Marchează wire-ul drept plagiat, deși fiecare publicație folosește aceeași arhivă sub licență - un fals pozitiv, frustrant la volum. Nu detectează deloc furtul de byline, fiindcă verifică doar ce trimiteți, nu și web-ul unde sunteți republicat. Corpus-ul Noplag wire-service (AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA) clasifică wire-ul ca WIRE, nu ca PLAGIAT. Serviciul de monitorizare byline urmărește web-ul după semnăturile republicate. Ambele sunt opțiuni — sunt stratul specific jurnalismului, de activat când verificarea de bază nu e suficientă.
Citiți ghidul de clasificare wireÎntrebările pe care chiar le pun reporterii.
- Va fi draftul stocat sau folosit pentru antrenarea modelelor?
- Nu. Drafturile sunt fingerprint-uite (hash-uri nonreversibile) și stocate în baza de date izolată. Textul se șterge după 30 de zile dacă nu optați pentru păstrare. Modelele de detecție (bazate pe Binoculars) sunt antrenate pe corpusuri publice; nu adăugăm drafturi de reporteri în seturi de training. Explícit în DPA.
- Cum funcționează clasificarea wire?
- Nivel Premium cu abonament corp wire-service (AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA). Match-urile wire sunt marcate WIRE, nu PLAGIAT - pentru că toate publicațiile cu feed folosesc sub licență. Configurați politicile per outlet: unii admit wire nelimitat, alții cer atribuție. Clasificarea apare la fiecare fragment.
- Ce se întâmplă cu comunicatele de presă?
- Sunt potrivite cu indexul de comunicate (PR Newswire, Business Wire, EurekAlert, PRWeb). Marcate REPRINT. Unele publicații permit citate de comunicat cu atribuire; altele (majoritatea US dailies) cer rescriere. Configurați politica outlet-ului; raportul afișează acțiunea necesară.
- Cum verifică AI colaboratorii externi?
- Detectarea AI va fi disponibilă în curând (este pe roadmap-ul v1.2). La lansare, va oferi o estimare a probabilității de text generat de AI pentru fiecare paragraf, cu verdict ajustat pentru ESL — concepută pentru redacții care verifică propuneri de la colaboratori externi, deoarece textele generate de AI sunt tot mai frecvente. Ajustarea pentru ESL este importantă pentru că stilul de scriere al vorbitorilor non-nativi de engleză se suprapune cu semnăturile AI (un studiu Stanford 2023 a găsit o rată de fals pozitiv de 61,3% la detectoarele naive); calibrarea noastră urmărește să reducă semnificativ această rată, iar valoarea reziduală va fi publicată după finalizarea evaluării funcției.
- Pot monitoriza byline-ul împotriva scraping-ului?
- Abonament Premium cu funcția watch byline. Adăugați materialele publicate în listă; scanare zilnică după domenii non-allowlisted. Fiecare flag include snapshot HTML hash-uit, datat la scraping — probă DMCA. Nu depunem DMCAs (e decizia consilierului dvs.); oferim documentația.
- Cum lucrează cu embargo-urile?
- Adăugați materiale sursă sub embargo într-un scope temporar cu dată. Match-urile pe conținut embargat sunt marcate EMBARGO-OK, apoi revine la standard. Relevant la știință (embargo NIH / EurekAlert) sau politică (transcripte cu embargo).
- Funcționează și pentru jurnalism în alte limbi?
- Detectarea este calibrată pentru engleză, spaniolă, portugheză, poloneză și ucraineană la lansare, urmând să fie adăugate și alte limbi. Calitatea detectării este evaluată pe PAN-PC-11; evaluarea pe fiecare limbă este planificată. Util pentru corespondenții internaționali care trimit materiale în mai multe limbi.
- Cum e API-ul pentru integrare CMS?
- REST + OpenAPI 3.0 spec. SDK-uri Python și Node generate din specificație. Webhook-uri pentru verificări asincrone la materiale lungi. POST /v1/checks din CMS-ul propriu la save_draft; raportul se atașează articolului ca metadate pentru audit-trail. Exemple de integrare cu WordPress, Ghost și Drupal la github.com/NoplagLabs/noplag-engine.
- Ce fac ca freelancer fără redacție?
- Gratuit până la 2.500 cuvinte / verificare, nelimitat, fără cont. Funcționează pe mobil (verificați pe telefon înainte de depunere din teren). Premium la 79 $/lună pentru corp wire și byline-watch + funcții la nivel de folder. Self-host gratuit Apache 2.0 dacă vreți totul local.
- Ce se întâmplă dacă citatul unei surse e generat AI?
- După lansarea detecției AI (în curând), verdictul va marca paragraful suspect cu bandă ESL. Dacă citatul atribuit e AI-likely, este un flag editorial — poate sursa a folosit AI, poate a parafrazat output AI, poate e fals pozitiv. Verdictul este doar semnal de a verifica direct cu sursa, nu descalificare automată.
Verificați înainte de editor.
Inserați materialul depus. Primiți raport pe paragraf în 47 de secunde: citate, suprapunere wire, autocitare, cu AI-likelihood în curând. Gratuit până la 2.500 de cuvinte. Premium pentru corpus wire și byline-watch.