Antiplagio per editori pre-pubblicazione e audit
Controlli pre-pubblicazione per invii freelance, audit per contenuti ripubblicati, e una REST API integrabile nel vostro CMS. Il motore di rilevamento è Apache 2.0 — leggibile prima dell’adozione, non dopo.
Quattro desk. Un workflow.
Verifica una proposta freelance prima dell’assegnazione
10 minuti per invio, prima che il budget di editing sia impegnato.
- Incolla una bozza/proposta, vedi le versioni precedenti pubblicate
- Probabilità AI per paragrafo (prossimamente), attenzione a testi ESL
- Evita lo scambio continuo su 'è originale?'
Controlla la coda della giornata prima della pubblicazione
Scansione bulk degli articoli di oggi prima che entrino in coda su CMS.
- Vista coda ordinata per similarità + punteggio AI
- Soglie configurabili per sezione (op-ed vs cronaca vs recensioni)
- Audit trail per reporter per desk standard
Indaga su un invio contestato
Leggi l’algoritmo, poi gli intervalli rilevati.
- Reproducibilità X-Engine-Commit
- Sovrascrivi il verdetto motivando via documentazione
- Apache 2.0 — difendibile durante revisioni e correzioni
Verifica i partner che ti ripubblicano
Monitora lo stato del tag canonico su tutta la rete syndication.
- Rilevamento consapevole del canonical (ORIGIN / SYND OK / LEAK)
- Report differenziale settimanale per partner
- Pack di prove formato DMCA su richiesta
Tre passaggi prima che l’articolo entri in coda su CMS.
Integrato nel vostro flusso editoriale via API, a batch prima della stampa, o singolarmente dalla dashboard. Stesso motore, stesso formato report, adattabile.
01 · Acquisizione
L’invio arriva nella coda CMS — drag-drop il .docx/.gdoc/incolla; o il CMS invia tramite webhook. Metadati autore + sezione + editor assegnato viaggiano col documento per il log di audit.
02 · Scansione + classificazione
Cascade su open web + Common Crawl + (opzionale) archivio personale. La classificazione citazioni separa le citazioni (con attribuzione) dalla parafrasi non citata. Stima AI per paragrafo in arrivo, attenzione ESL. Mediana 42s per articolo.
03 · Decidi + pubblica
L’editor vede: similarità del titolo, breakdown per categoria, elenco delle fonti ordinabile (punteggio AI + flag ESL in arrivo). Tre scelte: pubblica, restituisci con note, inoltra al desk standard. Decisione loggata con commit motore + snapshot corpus.
Quattro CMS. Un solo contratto REST.
Collega Noplag al CMS già in uso dai vostri reporter. L’API è la stessa — cambia solo lo strato di integrazione (hook WordPress, azioni Ghost, eventi Drupal, o vostri webhook).
Plugin ufficiale della Directory WordPress.org. Compatibile Gutenberg.
- Meta-box pre-pubblicazione su ogni tipo di post
- Evidenziazione a livello di blocco nell’editor
- Log di audit tramite WP REST API
Integrazione webhook + Admin API. Compatibile content per membri.
- Webhook pre-pubblicazione su save_draft
- Policy di scansione a livello tag per tipo contenuto
- Self-host friendly (Noplag self-host + Ghost self-host)
Modulo contrib da drupal.org, allegato via Field API.
- Campo plagio per ogni tipo di contenuto
- Integrazione workflow con Content Moderation
- Configurazione multi-sito supportata
Webhook + OpenAPI 3.0 spec. Per CMS headless, sistemi interni, o altro.
- POST /v1/checks da qualsiasi hook CMS
- Callback webhook firmati HMAC
- SDK Python + Node dal OpenAPI spec
Coda di pubblicazione di oggi. Ordinabile, audit log.
Righe per articolo, con autore, sezione, similarità, AI score, e accesso al report evidenziato. Ordinabile. Approvazione bulk degli articoli ok, escalation degli altri.
Veda chi la ripubblica — e se il tag canonical punta a casa.
Monitora la tua rete distribuzione
Aggiunga i domini su cui fa syndication (Medium, LinkedIn, Substack, altri partner) come lista permessa. Report settimanali dicono quali partner mantengono il rel=canonical verso di Lei (ORIGIN), quali lo omettono (LEAK SEO), e chi ripubblica senza permesso (SCRAPED).
Da quale blog manca il Suo byline?
I confronti mensili open-web rilevano se domini non in lista pubblicano intervalli dei Suoi articoli. Il match include snapshot datato — prova DMCA con data del primo scraping. Non inviamo DMCA (è una scelta legale); forniamo la documentazione.
Duplicazione interna sulle sue stesse pagine
Scansione folder a livello pro: carichi il corpus pubblicato in cartella; il motore costruisce la matrice similarità tra tutte le coppie. Trova le 47 pagine cittadine con lo stesso boilerplate — rischio Helpful-Content-Update da sapere prima di Google.
Tre policy che il desk standard chiede prima della firma contratto.
Primo: gli articoli inviati non vengono mai utilizzati per addestrare un modello. Né il nostro, né quello di altri. Il testo inviato viene sottoposto a fingerprinting, indicizzato nel tuo tenant e cancellato dopo 30 giorni, salvo conservazione esplicita. Secondo: il verdetto AI (in arrivo, previsto nella roadmap) sarà per paragrafo, non per articolo, e riporterà il commit dell’engine e il timestamp dello snapshot del corpus. Un flag AI contestato verrà riprodotto anche mesi dopo sullo stesso commit. Nessun riaddestramento silenzioso. Terzo: la licenza Apache 2.0 consente al tuo team tecnico di clonare github.com/NoplagLabs/noplag-engine, eseguirlo sulla propria infrastruttura, verificare i flussi di dati e controllare l’intero percorso di diritto alla cancellazione. La maggior parte delle valutazioni d’acquisto istituzionali di software antiplagio si blocca su questi tre punti; abbiamo cercato di rispondere in anticipo.
Leggi la guida desk standardCiò che il desk standard chiede davvero prima dell’acquisto.
- I nostri articoli saranno usati per addestrare il vostro modello AI?
- No. Gli articoli inviati sono fingerprintati (solo winnowing hash) e indicizzati in database isolato per tenant. Il testo è cancellato dopo 30 giorni salvo opt-in alla conservazione. Il modello di detection AI — basato su Binoculars (Hans et al. 2024), prossimo in roadmap — sarà preaddestrato su corpora pubblici; non aggiungiamo mai contenuti dei clienti. Esplicito nel DPA.
- Come viene giustificato un verdetto AI per paragrafo in caso di contestazione?
- Il rilevamento AI sarà disponibile a breve — è previsto nella roadmap della v1.2, non al lancio. Quando sarà attivo, ogni paragrafo segnalato riporterà il commit dell’engine e lo snapshot del corpus. Ripetendo il controllo sullo stesso paragrafo e commit, il verdetto sarà identico. L’algoritmo è consultabile su github.com/NoplagLabs/noplag-engine (Apache 2.0), con soglia di perplexity e documentazione della calibrazione per ESL. Non esiste una modalità “fidati del punteggio”.
- E i freelance che inviano da mercati a banda bassa?
- Il rilevamento è calibrato per inglese, spagnolo, portoghese, polacco e ucraino al lancio; altre lingue saranno aggiunte progressivamente. La qualità del rilevamento è misurata su PAN-PC-11; la valutazione per singola lingua è in roadmap. Il verdetto AI, regolato per ESL, segnala la scrittura non nativa in inglese come ESL ADJ invece di LIKELY-AI quando la firma lessicale lo indica.
- Possiamo fare self-host sui nostri sistemi editoriali?
- Sì — motore Apache 2.0 + Docker. Tutto in rete locale. Si abbina a vostro Postgres + Redis su infra esistente; nessun invio esce dalla VPC. Utile per redazioni con richieste di source-protection o confidenzialità pre-pubblicazione.
- Si integra col nostro CMS?
- WordPress (plugin ufficiale), Ghost (API admin + webhook), Drupal (modulo contrib). Per altro (custom CMS, headless, sistemi interni) — REST + OpenAPI 3.0 sono sufficienti per costruire un hook pre-pubblicazione anche in un giorno. SDK Python/Node dal OpenAPI spec.
- La funzione di syndication-audit cosa fa davvero?
- Aggiunga i suoi domini distribuiti come lista permessa (medium.com/@tuo_nome, domini partner). Crawl settimanale segnala stato tag canonical: ORIGIN (punta a Lei), SYND OK (da partner), LEAK (canonical mancante o mal indirizzato — rischio SEO), SCRAPED (copia verbatim, no canonical, dominio non ammesso). Categoria scraped ha snapshot datato per prova DMCA.
- Come funziona il prezzo per una redazione di 30 giornalisti?
- Premium a $79/mese per 5.000 parole/check, 5.000 articoli/mese, integrazioni API + CMS. Operazioni ad alto volume (10.000+ articoli/mese), Enterprise a prezzo su volume del corpus + infrastruttura dedicata. Nessun costo per 'utente'; scala sul volume.
- Cosa succede con op-ed, syndication, estratti libro dove riuso contenuti è normale?
- Soglie per sezione su Pro+ — impostate sensibilità specifica per news, op-ed, recensioni, estratti syndication. Un op-ed che cita un discorso ufficiale non attiva la soglia news. Il sistema di classificazione citazioni separa citazioni legittime da riuso accidentale.
- Rallenterà il flusso di pubblicazione?
- Mediana 47 secondi per articolo (1.500–4.000 parole). L’hook CMS è asincrono — parte col salvataggio bozza, l’editor vede il verdetto a fine correzioni. Articoli lunghi (8.000+ parole) richiedono circa 90 secondi, gestibili come job pre-pubblicazione non sincroni.
- Possiamo aggiungere il nostro archivio come corpus privato?
- Sì — tier Enterprise. Ingesta bulk degli archivi in corpus privato, e ogni nuovo invio viene controllato anche rispetto agli storici. Rileva auto-riciclo dei reporter (a volte legittimo, a volte no) e riuso intenzionale sotto autore nuovo.
Esegua una bozza in coda. Veda la vista per articolo.
Trascini un doc Word, Google Doc o esporti da CMS. Ottiene report per paragrafo in 47 secondi. Gratuito fino a 2.500 parole; Pro per alti volumi; Enterprise per corpus + infrastruttura dedicata.