Antiplagio per studi legali, controllo atti e casi
Verifica pre-deposito su atti, memorie e istanze. Individua sollevamenti senza attribuzione, boilerplate riciclato e testo generato da AI (con il rischio di casi allucinati che ne deriva). Privilegio mantenuto: engine self-host nella rete interna, o residenza UE per pratiche transfrontaliere. I documenti non vengono mai usati per l’addestramento. Mai.
Quattro ruoli. Un solo self-check pre-deposito.
Verifica atti prima della revisione partner
Individua il parafrase non citato che manca della citazione Bluebook prima che lo noti il partner.
- Self-check prima che il partner lo legga
- Classificazione citazioni Bluebook + ALWD
- Probabilità AI per paragrafo (se utilizzato un LLM)
Verifica pronta per il deposito
La firma è la vostra. L’originalità deve esserlo anch’essa.
- Allowlist auto-citazioni di studio (atti precedenti)
- Rilevamento casi allucinati (Mata v. Avianca come avvertimento)
- Audit trail per associate per prevenire malpractice
Discovery + flusso memorie
Verifica in bulk memorie e risposte discovery prima che vadano nel fascicolo.
- Cartella per pratica · isolamento fascicolo
- Residenza UE per discovery transfrontaliera
- Engine Apache 2.0 — difendibile in revisioni conflitti
Enforcement policy AI a livello studio
Verificate che la policy AI dello studio sia davvero rispettata.
- Rilevamento AI su tutti i prodotti inviati
- Log cancellazione per audit riservatezza cliente
- Self-host nella rete interna — privilegio mantenuto
Tre passaggi prima del tasto e-file.
Self-host nella rete interna dello studio, endpoint residenza UE per pratiche transfrontaliere, oppure cloud Pro con isolamento tenant. Scegliete la modalità che rispetta la confidenzialità della pratica.
01 · Redazione interna
Caricate atto / memoria / istanza (.docx più frequente; .pdf supportato). Il documento rimane nel tenant dello studio — controlli di accesso per il privilegio, nessun corpus condiviso, nessuna esposizione cross-tenant. Per self-host: il documento non esce mai dal vostro VPC.
02 · Verifica sulle fonti corrette
Il cascade verifica su web aperto + Common Crawl + archivi opinioni aperti (CourtListener, Caselaw Access Project, Google Scholar, Justia). Classificazione citazione distingue i case quote Bluebook da parafrasi non citate. Probabilità AI per paragrafo — importante, dato che i casi allucinati sono rischio reale in tribunale.
03 · Verifica prima del deposito
Il report classifica ogni intervallo: QUOTED·CITED (caso attribuito Bluebook, escluso), CASE·QUOTE (nome caso + citazione reporter, escluso), PARA·CITED (parafrasi con citazione, peso basso), UNCITED·PARA (da rivedere), AI·LIKELY (verificare o riscrivere), HALLUCINATED·RISK (caso citato assente da tutti gli archivi opinioni — da verificare prima del deposito).
Sei cose da verificare prima del deposito di un atto scritto con AI.
Mata v. Avianca (S.D.N.Y. 2023) è stato un segnale: citati sei casi inventati da ChatGPT; sanzione $5.000 e danno pubblico allo studio. Il testo legale redatto da AI richiede un suo livello di verifica.
01 · ESISTENZA DELLA CITAZIONE
Ogni caso citato è incrociato sugli archivi opinioni aperti (CourtListener, Caselaw Access Project, Google Scholar, Justia). Se il nome caso + citazione non dà risultati su tutti e 4, il report segnala HALLUCINATED-RISK. Non vuol dire che il caso sia falso (può essere non pubblicato, secretato o dietro paywall); vuol dire di verificare prima di depositare.
02 · FEDELTÀ DELLA QUOTAZIONE
Se un atto cita un caso, l'engine verifica il testo contro l'opinione. Se il caso esiste ma il testo non compare, è 'QUOTE-DRIFT' — tipico errore LLM. Segnalato separatamente dalla verifica esistenza.
03 · PRECISIONE DEL PINCITE
Verifica delle pagine (pin-cite). La pagina citata deve contenere il testo riportato, o no. Errore LLM comune: caso vero, pagina reale, testo da altro paragrafo. Segnalato come PINCITE-MISMATCH.
04 · HOLDING vs DICTUM
Funzionalità beta (Pro+). L'engine controlla se la proposizione citata è del holding o dictum. Scambiare dictum per holding è errore LLM frequente, rischio malpractice.
05 · SUPERATO / ANNULLATO
Controllo storico con CourtListener. Se un caso è stato superato, annullato o distinto da successive sentenze nel circuito rilevante, compare nel report. Anche una citazione corretta può essere diritto superato.
06 · PARAGRAFI PROBABILI AI
Probabilità AI a paragrafo (su base Binoculars) in arrivo — in roadmap, non al lancio. I paragrafi segnalati andranno verificati prima del deposito. Adattato per ESL su studi con avvocati non madrelingua inglese — il report indica ESL ADJ, non LIKELY-AI, quando la firma lessicale lo indica.
Cosa vedete prima del tasto e-file.
Classificazione per paragrafo: casi citati verificati, parafrasi attribuite o meno, paragrafi segnati AI, e soprattutto la segnalazione HALLUCINATED-RISK su ogni citazione non trovata in archivio opinioni.
Tre requisiti su riservatezza per un checker.
Engine installato nella rete dello studio
Apache 2.0 + Docker. Affiancabile a Postgres + Redis già usati nella vostra infrastruttura. Documento, fingerprint e report rimangono sui vostri server. Nessun traffico esce dal VPC. La soluzione giusta per pratiche con protective order, discovery secretata o draft sensibili al work-product.
Per pratiche con giurisdizione UE
Pro+ su api.eu.noplag.com. Hostato su data centre Hetzner EU (Falkenstein + Helsinki). Documento, fingerprint e report restano in UE. GDPR di default; DPA su richiesta. Utile per clienti/dossier UE/UK, materie GDPR e clienti domiciliati UE.
Gli atti inviati non diventano training data
Il draft viene fingerprintato (winnowing hash, firma non reversibile) e conservato in database isolato per tenant. Testo cancellato dopo 30 giorni salvo retention. Modelli addestrati solo su corpora pubblici — nessun atto studio nel training. Esplicito nel DPA.
Due esigenze delle pratiche multi-giurisdizione che gli altri strumenti non coprono.
Quasi tutti gli strumenti contro il plagio coprono una sola giurisdizione — quasi sempre US federal. Le pratiche cross-border coinvolgono archivi multipli (federali US + statali + stati membri UE + UK + Commonwealth), regole citation diverse (Bluebook, OSCOLA, McGill Guide, AGLC), e più lingue (redazione legale anche francese, tedesco, spagnolo, portoghese per pratiche sudamericane). Il cascade copre tutto. Endpoint residenza UE copre il data placement. Self-host copre dove cloud non basta.
Leggi la guida alle pratiche cross-borderDomande dei managing partner prima dell’acquisto.
- I nostri atti diventano dati di training?
- No. I draft sono fingerprintati (winnowing hash, non reversibili) e conservati in database isolati per tenant. Testo cancellato dopo 30 giorni salvo retention. I modelli sono addestrati solo su corpora pubblici; mai atti studio nel set. Esplicitato nel DPA. Chi self-hosta tiene tutto dentro il proprio VPC — nemmeno i fingerprint escono.
- Come funziona il rilevamento casi allucinati?
- Ogni accoppiata nome-caso + citazione è controllata su quattro archivi: CourtListener, Caselaw Access Project (Harvard), Google Scholar, Justia. Se una citazione ha zero riscontri su tutti e quattro, il report segnala HALLUCINATED-RISK. Non vuol dire che il caso sia finto — può essere non pubblico, secretato o paywall — vuol dire verificare con Westlaw / Lexis prima del deposito. Mata v. Avianca è il caso per cui l’abbiamo fatto.
- Funziona con casi non-US?
- US federale + statale, UK + Commonwealth (citazioni OSCOLA), canadese (McGill Guide), australiano (AGLC), UE (ECJ + ECHR). Il cascade indicizza archivi da Bailii (UK), CanLII (Canada), AustLII, e Curia UE. Casi vecchi dietro paywall (Westlaw / Lexis / juris) non compaiono — stesso limite di iThenticate sugli articoli accademici a pagamento.
- Come è tutelato il privilegio nelle pratiche sensibili?
- Tre livelli. Cloud Pro: database isolato per tenant, residenza UE su richiesta, purge testo dopo 30 giorni. Endpoint UE (api.eu.noplag.com): host tutto in data centre EU Hetzner, GDPR Art.28. Self-host: Apache 2.0 + Docker, tutto in VPC vostro, nessun traffico in uscita. Scegliete il livello richiesto dalla protective order.
- Gestisce davvero le citazioni Bluebook?
- Sì — Bluebook 21ª edizione, ALWD, OSCOLA (UK), McGill Guide (Canada), AGLC (Australia). Formato auto-detect sulle referenze già presenti. Casi con citazioni corrette sono esclusi dal punteggio similarity principale. Citazioni errate sono segnalate separatamente — non come plagio, ma come errore di formato che può essere corretto.
- Cosa fare con discovery protetta da protective order?
- Self-host engine nella vostra rete — Apache 2.0 + Docker. Materiale sotto protective order, trascrizioni sealed, e discovery trade-secret non dovrebbero mai andare su cloud esterno, a prescindere dalle rassicurazioni del vendor. Self-host significa “mai lascia il VPC”, non “fidatevi del nostro cloud”. La maggior parte degli studi in contenzioso commerciale adotta questo metodo.
- Il rilevatore AI resiste ad una hearing sanzionatoria?
- AI detection in arrivo — in roadmap, non disponibile al lancio — ma la metodologia è aperta (Binoculars, Hans et al. 2024, paper peer reviewed). Ogni paragrafo segnalato include commit engine e snapshot corpus. Rilanciando il check sullo stesso commit il verdetto si riproduce. Tool closed-source non superano questo test — i tribunali iniziano a escluderli come Daubert-inammissibili. Il nostro è rivedibile; non diciamo che il verdetto è perfetto, ma è difendibile.
- Quanto costa per uno studio di 40 avvocati?
- Premium $79/mese copre usage per avvocato fino a 5.000 parole/check, 5.000 documenti/mese, REST API + integrazione LMS. Studi con discovery bulk (10.000+ documenti/mese): contratto Enterprise su corpus + infrastruttura dedicata. Licenze utente non alla base del prezzo; è il volume che scala.
- Integrabile col nostro DMS (iManage, NetDocuments, OpenText)?
- Il livello Pro+ offre integrazione tramite webhook e REST API. iManage e NetDocuments supportano entrambi webhook in uscita al salvataggio del documento; configura il webhook per inviare una richiesta POST a /v1/checks; il report viene allegato al documento come campo di metadati. OpenText eDOCS supporta la stessa funzione tramite Content Server hooks. Script di integrazione di esempio per tutti e tre disponibili su github.com/NoplagLabs/noplag-engine/integrations.
- Per ediscovery: funziona per i documenti prodotti?
- Casistica diversa dalla verifica atti — l’ediscovery serve a classificare prodotti (responsive / non-responsive / privileged), non a verificare i propri atti per plagio. Noplag non è piattaforma ediscovery (Relativity / Everlaw / Disco sono leader per questo). Ma per verificare che la work-product in risposta discovery sia originale e AI-free, Noplag è adatto.
Controllate l’atto col cascade. Prima dell’e-file.
Caricate atto o istanza. Ricevete report per paragrafo con verifica citazione, rilevamento casi allucinati, e probabilità AI. Free tier fino a 2.500 parole; Pro per volumi studio; Enterprise per self-host + infrastruttura dedicata.