Antiplagio per giornalisti pre-pubblicazione e furto di firma
Autocontrollo pre-file prima che lo legga il redattore. Rileva parafrasi e testi da comunicato; rilevamento di AI in arrivo. E: indica chi sta ripubblicando la Sua byline. Gratuito fino a 2.500 parole; REST API per integrazione in redazione se invia da CMS.
Quattro flussi di lavoro. Un solo autocontrollo.
Archiviazioni quotidiane a scadenza
Lo vede il redattore dopo di Lei — meglio fare pulizia prima.
- Autocontrollo di 30 secondi su 900 parole
- Boilerplate da comunicato segnalato automaticamente
- Sovrapposizione con agenzia segnalata prima della pubblicazione
Long form con ricerca riutilizzata
Un pezzo di 5.000 parole attinge a interviste e lavori precedenti.
- Autocitazione: suoi pezzi precedenti taggati SELF-CITE
- Classificazione citazione/para. con attribuzione
- Sensibile a embargo: verifica solo materiale sbloccato
Mesi di fonti in un solo pezzo
Individua citazioni senza attribuzione scivolate nella bozza.
- Verifica attribuzione fonte su ogni paragrafo
- Ricerca su raccolta fonti nella Sua cartella
- Snapshot DMCA quando il Suo scoop viene ripubblicato
Archivi multipli, nessun QA interno
È Lei il redattore; l’autocontrollo è l’unica verifica.
- Check mobile sul telefono, anche sul campo
- Autoriciclaggio cross-testata segnalato se fuori allowlist
- Il piano gratuito copre 2.500 parole, caso tipico
Tre passaggi prima di archiviare.
Integrato nella pipeline via API, oppure singolo check da dashboard. Stesso motore. Stesso report. Sempre 47 secondi.
01 · Autocontrollo bozza
Incolli o carichi il file. Aggiunga la Sua allowlist byline (interi archivi suoi, lista di agenzie da Lei syndicate). Il motore distingue parafrasi involontaria di Suo testo precedente (legittima) da quella su testo altrui (non legittima).
02 · Verifica le fonti
Il report indica ogni intervallo trovato: URL fonte, stato canonical-tag, data snapshot. Comunicati vengono taggati REPRINT (alcune testate accettano citazione testuale con attribuzione, altre no). A breve: classificazione AI per paragrafo, calibrata per scrittori ESL.
03 · Decida prima di inviare
Guardi la classificazione: citazioni attribuite (escluse dal punteggio), parafrasi con citazione (peso basso), parafrasi senza citazione (da correggere). Con il rilevamento AI, dove serve segnalazione o riscrittura, seguirà la policy sua/testata. Quando è tutto pulito, archivi. Il report si allega al file come prova.
Sei cose da controllare in ogni paragrafo.
Ogni categoria è affiancata al suo intervallo. Auto-segnali dove la policy richiede attribuzione. Si chiede: “lo accetterebbe la stanza standard?”
01 · CITAZIONE DIRETTA
Virgolette + attribuzione nella stessa frase. Conta come citato, escluso dal punteggio. Dettagliato rispetto alla Sua cartella trascrizioni se carica interviste come fonte.
02 · COMUNICATO
Testo identico rispetto a un comunicato pubblico. Tag REPRINT. Alcuni outlet accettano citazione con attribuzione; altri (Molti US daily) richiedono riscrittura. Configuri nel profilo testata.
03 · AGENZIA
Match con feed AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA (tier Premium con corpus di agenzia). Il wire può essere riscritto secondo la Sua licenza. L'origine wire è confermata per distinguere cosa è in licenza e cosa no.
04 · EMBARGO
Aggiunge press kit embargo a uno scope temporaneo. Sensibile a embargo: tag EMBARGO-OK finché attivo, poi torna a classificare regolarmente. Utile per il giornalismo scientifico.
05 · AI (IN ARRIVO)
Classificazione AI per paragrafo, calibrata per scrittori ESL, è in roadmap. Pensato per controllare submission freelance — ormai frequenti. Metodologia aperta (Binoculars, Hans et al. 2024).
06 · SUO CONTENUTO GIÀ PUBBLICATO
Allowlist byline: archivio pubblicato, sito portafoglio, Substack, Medium. Autoriciclaggio segnalato come SELF-CITE — comune nei long form. Non gonfia il punteggio; resta comunque segnalato.
Cosa si vede dopo 47 secondi su un pezzo da 1.500 parole.
Classificazione per paragrafo: URL fonte, stato attribuzione, click su intervallo. Difendibile in riunione standard; ripetibile con commit engine in report.
Tre cose da fare se trova il suo scoop sotto un’altra byline.
Imposti la sua byline come query monitorata
Incolli il pezzo pubblicato (o lista pezzi) nella watch list. Scansione web giornaliera segnala domini non-allowlist che pubblicano i suoi testi: copia, parafrasi leggere, versioni AI. La notifica include URL colpevole, paragrafi trovati, timestamp del prelievo.
Snapshot DMCA, datato e hashato
Ogni scraping include snapshot HTML della pagina sorgente, data e hash per prova anti-manomissione. Allegando timestamp della Sua fonte (CMS, tweet, Wayback) ha la catena di priorità.
Sua byline su syndication legittima
Se syndica su Medium, LinkedIn, Substack, o partner, il motore verifica il canonical; ORIGIN fa sì che il SEO vada a Lei; LEAK segnala dispersione. LinkedIn spesso toglie canonical tag di default.
Due esigenze tipiche dei giornalisti che i tool accademici ignorano.
Quasi tutti gli strumenti antiplagio sono pensati per l’accademia. Segnalano wire copy come plagio, quando tutti i giornali pubblicano lo stesso feed AP sotto licenza — un falso positivo di massa. Ignorano il furto byline: controllano solo quello che inserisce, non il web che la ripubblica. Il corpus wire di Noplag (AP, Reuters ecc.) tagga il wire come WIRE, non PLAGIARISM. Il servizio byline monitora il web per riportare i casi di ripubblicazione. Entrambe le funzioni sono disattivate all’avvio: sono la parte specifica su misura per il giornalismo, da attivare quando serve un controllo diverso.
Guarda la guida alla classificazione wireLe domande reali dei giornalisti.
- I miei testi sono archiviati o usati per training?
- No. I file sono fingerprinted (winnowing hash, non reversibile) e archiviati su database isolato. Testo cancellato dopo 30 giorni, salvo scelta di conservazione. I modelli (su base Binoculars) sono pre-addestrati su corpora pubblici; non usiamo i Suoi articoli per train. È scritto chiaramente nella DPA.
- Come funziona la classificazione wire?
- Tier Premium con corpus di agenzia (AP, ecc.). I match su feed wire sono taggati WIRE — non PLAGIARISM — perché i giornali usano questi testi con licenza. Configuri la policy per testata: alcuni permettono wire infinito, altri vogliono attribuzione. L’esito compare su ogni intervallo.
- E i comunicati stampa?
- Match rispetto all’indice pubblico (PR Newswire, Business Wire ecc), taggato REPRINT. Alcune testate accettano citazione, altre (la maggioranza delle US daily) vogliono riscrittura. Configuri in Impostazioni, il report suggerisce l’azione richiesta.
- Come gestirà l’AI-detection le submission freelance?
- La rilevazione di contenuti AI sarà disponibile a breve (prevista nella roadmap v1.2). Quando verrà rilasciata, fornirà una stima della probabilità di testo generato da AI per ogni paragrafo, con un giudizio adattato per chi scrive in inglese come seconda lingua — pensato per le redazioni che valutano proposte da freelance, dato che i contributi generati da AI sono sempre più frequenti. L’adattamento per ESL è importante perché gli schemi tipici di chi scrive in inglese non madrelingua possono coincidere con quelli della AI (Stanford 2023 ha rilevato un 61,3% di falsi positivi sui rilevatori non calibrati); la nostra calibrazione mira a ridurre sensibilmente questo tasso, che sarà pubblicato quando la funzione supererà la fase di valutazione.
- Posso monitorare le mie byline pubblicate per scraping?
- Con Premium + byline-watch, aggiunga pezzi pubblicati nella watch list; scansione giornaliera rileva domini non allowlist. Ogni flag ha snapshot HTML hashato e datato — pack DMCA. Non presentiamo DMCAs (spetta all’avvocato); forniamo i documenti.
- E sulle fonti sotto embargo?
- Aggiunga materiali sotto embargo a uno scope provvisorio, con data. Fino a scadenza: tag EMBARGO-OK. Poi trattamento normale. Utile per scienza (es. NIH / EurekAlert) e policy (es. audizioni Congresso).
- Funziona per servizi non in inglese?
- La rilevazione è calibrata per inglese, spagnolo, portoghese, polacco e ucraino al lancio; altre lingue verranno aggiunte progressivamente. La qualità della rilevazione è valutata su PAN-PC-11; la valutazione per singola lingua è prevista in roadmap. Utile per i corrispondenti internazionali che inviano testi in più lingue.
- Com’è l’API per l’integrazione nel CMS in redazione?
- REST + specifica OpenAPI 3.0. Gli SDK Python e Node sono generati dalla specifica. Webhook disponibili per controlli asincroni su testi lunghi. POST /v1/checks dal tuo CMS tramite hook su save_draft; il report viene allegato all’articolo come metadato di audit-trail. Esempi di integrazione con WordPress, Ghost e Drupal su github.com/NoplagLabs/noplag-engine.
- Freelance senza redazione: che succede?
- Il piano gratuito copre 2.500 parole a check, verifica illimitata, senza signup. Mobile pronto — può fare tutto dal telefono, anche sul campo. Premium a $79/mese per corpus wire, byline-watch e funzioni cartella. Self-host anche gratis su Apache 2.0, se vuole tutto locale.
- E se una citazione da fonte viene da AI?
- Con AI-detection (in arrivo), il verdetto AI paragrafo esporrà quello sospetto, con banda ESL. Se la citazione risulta AI-likely, è una segnalazione editoriale — può essere una dichiarazione generata da AI, una parafrasi AI fatta dalla fonte, o falso positivo. L’esito invita a verificare la fonte, non esclude automaticamente il testo.
Controlli prima del redattore.
Incolli il file. Ottenga report per paragrafo in 47 secondi: citazioni, wire overlap, self-cite, AI-likelihood in arrivo. Gratis fino a 2.500 parole. Premium per corpus wire-byline.