NEWSROOMWorkflow editoriale · API CMS · audit syndication

Antiplagio per editori pre-pubblicazione e audit

Controlli pre-pubblicazione per invii freelance, audit per contenuti ripubblicati, e una REST API integrabile nel vostro CMS. Il motore di rilevamento è Apache 2.0 — leggibile prima dell’adozione, non dopo.

Workflow pre-pubblicazioneAudit syndicationREST API pronta per CMS
PER CHI APPROVA LA PUBBLICAZIONE

Quattro desk. Un workflow.

EDITOR

Verifica una proposta freelance prima dell’assegnazione

10 minuti per invio, prima che il budget di editing sia impegnato.

  • Incolla una bozza/proposta, vedi le versioni precedenti pubblicate
  • Probabilità AI per paragrafo (prossimamente), attenzione a testi ESL
  • Evita lo scambio continuo su 'è originale?'
MANAGING EDITOR

Controlla la coda della giornata prima della pubblicazione

Scansione bulk degli articoli di oggi prima che entrino in coda su CMS.

  • Vista coda ordinata per similarità + punteggio AI
  • Soglie configurabili per sezione (op-ed vs cronaca vs recensioni)
  • Audit trail per reporter per desk standard
DESK STANDARD

Indaga su un invio contestato

Leggi l’algoritmo, poi gli intervalli rilevati.

  • Reproducibilità X-Engine-Commit
  • Sovrascrivi il verdetto motivando via documentazione
  • Apache 2.0 — difendibile durante revisioni e correzioni
SYNDICATION

Verifica i partner che ti ripubblicano

Monitora lo stato del tag canonico su tutta la rete syndication.

  • Rilevamento consapevole del canonical (ORIGIN / SYND OK / LEAK)
  • Report differenziale settimanale per partner
  • Pack di prove formato DMCA su richiesta
WORKFLOW PRE-PUBBLICAZIONE

Tre passaggi prima che l’articolo entri in coda su CMS.

Integrato nel vostro flusso editoriale via API, a batch prima della stampa, o singolarmente dalla dashboard. Stesso motore, stesso formato report, adattabile.

01

01 · Acquisizione

L’invio arriva nella coda CMS — drag-drop il .docx/.gdoc/incolla; o il CMS invia tramite webhook. Metadati autore + sezione + editor assegnato viaggiano col documento per il log di audit.

02

02 · Scansione + classificazione

Cascade su open web + Common Crawl + (opzionale) archivio personale. La classificazione citazioni separa le citazioni (con attribuzione) dalla parafrasi non citata. Stima AI per paragrafo in arrivo, attenzione ESL. Mediana 42s per articolo.

03

03 · Decidi + pubblica

L’editor vede: similarità del titolo, breakdown per categoria, elenco delle fonti ordinabile (punteggio AI + flag ESL in arrivo). Tre scelte: pubblica, restituisci con note, inoltra al desk standard. Decisione loggata con commit motore + snapshot corpus.

INTEGRAZIONI CMS

Quattro CMS. Un solo contratto REST.

Collega Noplag al CMS già in uso dai vostri reporter. L’API è la stessa — cambia solo lo strato di integrazione (hook WordPress, azioni Ghost, eventi Drupal, o vostri webhook).

WordPress5.5+

Plugin ufficiale della Directory WordPress.org. Compatibile Gutenberg.

  • Meta-box pre-pubblicazione su ogni tipo di post
  • Evidenziazione a livello di blocco nell’editor
  • Log di audit tramite WP REST API
Ghost4.0+

Integrazione webhook + Admin API. Compatibile content per membri.

  • Webhook pre-pubblicazione su save_draft
  • Policy di scansione a livello tag per tipo contenuto
  • Self-host friendly (Noplag self-host + Ghost self-host)
Drupal9+ / 10

Modulo contrib da drupal.org, allegato via Field API.

  • Campo plagio per ogni tipo di contenuto
  • Integrazione workflow con Content Moderation
  • Configurazione multi-sito supportata
CustomREST

Webhook + OpenAPI 3.0 spec. Per CMS headless, sistemi interni, o altro.

  • POST /v1/checks da qualsiasi hook CMS
  • Callback webhook firmati HMAC
  • SDK Python + Node dal OpenAPI spec
VISTA EDITORIALE

Coda di pubblicazione di oggi. Ordinabile, audit log.

Righe per articolo, con autore, sezione, similarità, AI score, e accesso al report evidenziato. Ordinabile. Approvazione bulk degli articoli ok, escalation degli altri.

CODA PUBBLICAZIONE · martedì 21 maggio7 articoli pendenti · 2 in escalation
Sezione: TutteBulk pubblicazione OK
ARTICOLOAUTORESEZIONESIMILARITÀ% AIVERDETTOAZIONE
Il consiglio approva la nuova legge urbanistica per il centrobozza · 1.840 paroleMarisol ChenLOCALE6%0.04OKPubblica
Dentro la ricostruzione: lezioni dal fiasco Q1bozza · 1.840 paroleTobias ReinhartTECH12%0.08OKPubblica
Come l’AI ha cambiato la redazione in 18 mesibozza · 1.840 parolePriya AnandOPINIONE38%0.62IN ATTESARevisiona
Romanzi modernisti e la questione della vocebozza · 1.840 paroleSara BeltranCULTURA22%0.18OKPubblica
Senato regionale, scontro sulla legge finanziaria — cosa succede orabozza · 1.840 paroleMarcus AdekunlePOLITICA67%0.41ESCALATIONRevisiona
Profughi climatici: cinque anni dopobozza · 1.840 paroleYuki HiranoINCHIESTA14%0.06OKPubblica
Utile tech: chi ha superato, chi ha mancatobozza · 1.840 paroleDiego MoralesBUSINESS51%0.28IN ATTESARevisiona
7 su 7 visualizzati · ordinati per sezione, poi ora invioaudit log: 47 decisioni oggi · 2 in escalation
47stempo mediano di controllo per articolo
4integrazioni CMS
RESTOpenAPI 3.0 · pronto self-hosting
0invii usati per training (policy)
5lingue rilevate, in espansione
AUDIT SYNDICATION

Veda chi la ripubblica — e se il tag canonical punta a casa.

01 · SALUTE DEL CANONICAL

Monitora la tua rete distribuzione

Aggiunga i domini su cui fa syndication (Medium, LinkedIn, Substack, altri partner) come lista permessa. Report settimanali dicono quali partner mantengono il rel=canonical verso di Lei (ORIGIN), quali lo omettono (LEAK SEO), e chi ripubblica senza permesso (SCRAPED).

Cattura la ripubblicazione su LinkedIn che ha perso il canonical per rimozione dalla piattaforma.
02 · RILEVAMENTO SCRAPER

Da quale blog manca il Suo byline?

I confronti mensili open-web rilevano se domini non in lista pubblicano intervalli dei Suoi articoli. Il match include snapshot datato — prova DMCA con data del primo scraping. Non inviamo DMCA (è una scelta legale); forniamo la documentazione.

Esporti il pacchetto prove in PDF per la direzione legale.
03 · AUDIT BOILERPLATE

Duplicazione interna sulle sue stesse pagine

Scansione folder a livello pro: carichi il corpus pubblicato in cartella; il motore costruisce la matrice similarità tra tutte le coppie. Trova le 47 pagine cittadine con lo stesso boilerplate — rischio Helpful-Content-Update da sapere prima di Google.

Faccia settimanale; esporti la matrice come CSV.
PRINCIPI NEWSROOM

Tre policy che il desk standard chiede prima della firma contratto.

Primo: gli articoli inviati non vengono mai utilizzati per addestrare un modello. Né il nostro, né quello di altri. Il testo inviato viene sottoposto a fingerprinting, indicizzato nel tuo tenant e cancellato dopo 30 giorni, salvo conservazione esplicita. Secondo: il verdetto AI (in arrivo, previsto nella roadmap) sarà per paragrafo, non per articolo, e riporterà il commit dell’engine e il timestamp dello snapshot del corpus. Un flag AI contestato verrà riprodotto anche mesi dopo sullo stesso commit. Nessun riaddestramento silenzioso. Terzo: la licenza Apache 2.0 consente al tuo team tecnico di clonare github.com/NoplagLabs/noplag-engine, eseguirlo sulla propria infrastruttura, verificare i flussi di dati e controllare l’intero percorso di diritto alla cancellazione. La maggior parte delle valutazioni d’acquisto istituzionali di software antiplagio si blocca su questi tre punti; abbiamo cercato di rispondere in anticipo.

Leggi la guida desk standard
NEWSROOM Q&A
Q1Il motore apprende dai nostri articoli? — No. Il contenuto viene solo fingerprintato; mai usato per addestramento.
Q2Possiamo fare self-host? — Sì. Apache 2.0 + Docker. Tutto interno alla sua rete.
Q3E la residenza dati UE? — Pro+ su api.eu.noplag.com. GDPR by default.
Q4Report riproducibili? — Ogni controllo marca X-Engine-Commit e snapshot corpus. Riproducibile mesi dopo.
Q5Prezzi bulk? — Volume per articolo su Pro, Enterprise a corpus + infrastruttura dedicata.
Q6Attribuzione fonti? — Ogni intervallo matched ha l’URL di origine, tag canonico, data snapshot, engine commit.
FAQ

Ciò che il desk standard chiede davvero prima dell’acquisto.

I nostri articoli saranno usati per addestrare il vostro modello AI?
No. Gli articoli inviati sono fingerprintati (solo winnowing hash) e indicizzati in database isolato per tenant. Il testo è cancellato dopo 30 giorni salvo opt-in alla conservazione. Il modello di detection AI — basato su Binoculars (Hans et al. 2024), prossimo in roadmap — sarà preaddestrato su corpora pubblici; non aggiungiamo mai contenuti dei clienti. Esplicito nel DPA.
Come viene giustificato un verdetto AI per paragrafo in caso di contestazione?
Il rilevamento AI sarà disponibile a breve — è previsto nella roadmap della v1.2, non al lancio. Quando sarà attivo, ogni paragrafo segnalato riporterà il commit dell’engine e lo snapshot del corpus. Ripetendo il controllo sullo stesso paragrafo e commit, il verdetto sarà identico. L’algoritmo è consultabile su github.com/NoplagLabs/noplag-engine (Apache 2.0), con soglia di perplexity e documentazione della calibrazione per ESL. Non esiste una modalità “fidati del punteggio”.
E i freelance che inviano da mercati a banda bassa?
Il rilevamento è calibrato per inglese, spagnolo, portoghese, polacco e ucraino al lancio; altre lingue saranno aggiunte progressivamente. La qualità del rilevamento è misurata su PAN-PC-11; la valutazione per singola lingua è in roadmap. Il verdetto AI, regolato per ESL, segnala la scrittura non nativa in inglese come ESL ADJ invece di LIKELY-AI quando la firma lessicale lo indica.
Possiamo fare self-host sui nostri sistemi editoriali?
Sì — motore Apache 2.0 + Docker. Tutto in rete locale. Si abbina a vostro Postgres + Redis su infra esistente; nessun invio esce dalla VPC. Utile per redazioni con richieste di source-protection o confidenzialità pre-pubblicazione.
Si integra col nostro CMS?
WordPress (plugin ufficiale), Ghost (API admin + webhook), Drupal (modulo contrib). Per altro (custom CMS, headless, sistemi interni) — REST + OpenAPI 3.0 sono sufficienti per costruire un hook pre-pubblicazione anche in un giorno. SDK Python/Node dal OpenAPI spec.
La funzione di syndication-audit cosa fa davvero?
Aggiunga i suoi domini distribuiti come lista permessa (medium.com/@tuo_nome, domini partner). Crawl settimanale segnala stato tag canonical: ORIGIN (punta a Lei), SYND OK (da partner), LEAK (canonical mancante o mal indirizzato — rischio SEO), SCRAPED (copia verbatim, no canonical, dominio non ammesso). Categoria scraped ha snapshot datato per prova DMCA.
Come funziona il prezzo per una redazione di 30 giornalisti?
Premium a $79/mese per 5.000 parole/check, 5.000 articoli/mese, integrazioni API + CMS. Operazioni ad alto volume (10.000+ articoli/mese), Enterprise a prezzo su volume del corpus + infrastruttura dedicata. Nessun costo per 'utente'; scala sul volume.
Cosa succede con op-ed, syndication, estratti libro dove riuso contenuti è normale?
Soglie per sezione su Pro+ — impostate sensibilità specifica per news, op-ed, recensioni, estratti syndication. Un op-ed che cita un discorso ufficiale non attiva la soglia news. Il sistema di classificazione citazioni separa citazioni legittime da riuso accidentale.
Rallenterà il flusso di pubblicazione?
Mediana 47 secondi per articolo (1.500–4.000 parole). L’hook CMS è asincrono — parte col salvataggio bozza, l’editor vede il verdetto a fine correzioni. Articoli lunghi (8.000+ parole) richiedono circa 90 secondi, gestibili come job pre-pubblicazione non sincroni.
Possiamo aggiungere il nostro archivio come corpus privato?
Sì — tier Enterprise. Ingesta bulk degli archivi in corpus privato, e ogni nuovo invio viene controllato anche rispetto agli storici. Rileva auto-riciclo dei reporter (a volte legittimo, a volte no) e riuso intenzionale sotto autore nuovo.

Esegua una bozza in coda. Veda la vista per articolo.

Trascini un doc Word, Google Doc o esporti da CMS. Ottiene report per paragrafo in 47 secondi. Gratuito fino a 2.500 parole; Pro per alti volumi; Enterprise per corpus + infrastruttura dedicata.

Antiplagio per editori pre-pubblicazione e audit