Statistiche sul plagio
Fonti dei dati

Origine dei dati numerici.

Ogni fonte è gratuita e con licenza open source. Il punto indica come viene prodotto il dato — conteggiato da registri primari o compilato da fonti curate. Il calcolo completo è illustrato nella pagina della metodologia.

Tier 1 — high-authority datasets (the rate data)

Retraction events + categorized reasons (the plagiarism numerator).

Free, Crossref-hosted

Monthly snapshots

Publications, ROR-resolved affiliations, disciplines (denominators + the DOI join).

Free, CC0

Real-time

DOI metadata linking retractions to works.

Free API

Continuous

Canonical institution identifiers (the disambiguation backbone).

Free, CC0

Tier 2 — curated sources (the case data + signal)
Weekly

Notable plagiarism cases (Category:Plagiarism controversies, scientific misconduct).

Free, CC-BY-SA

Daily

Global news-volume index + recent coverage (current-events signal).

Free, DOC 2.0 API

I registri giudiziari (CourtListener) e i documenti societari (SEC EDGAR) sono stati valutati ma non inclusi: le corrispondenze testuali complete sono troppo rumorose per un'attribuzione affidabile. La giurisprudenza dell'UE e i rapporti nazionali su illeciti accademici (UK QAA, DFG tedesca) sono fonti manuali previste nella roadmap.
Fonti dei dati e qualità — Statistiche sul plagio