Estatísticas de Plágio
Fontes de dados

Origem dos dados apresentados.

Todas as fontes são gratuitas e possuem licenças abertas. O ponto indica como o dado foi produzido — contabilizado a partir de registros primários ou compilado de fontes curadas. O cálculo completo está na página de metodologia.

Tier 1 — high-authority datasets (the rate data)

Retraction events + categorized reasons (the plagiarism numerator).

Free, Crossref-hosted

Monthly snapshots

Publications, ROR-resolved affiliations, disciplines (denominators + the DOI join).

Free, CC0

Real-time

DOI metadata linking retractions to works.

Free API

Continuous

Canonical institution identifiers (the disambiguation backbone).

Free, CC0

Tier 2 — curated sources (the case data + signal)
Weekly

Notable plagiarism cases (Category:Plagiarism controversies, scientific misconduct).

Free, CC-BY-SA

Daily

Global news-volume index + recent coverage (current-events signal).

Free, DOC 2.0 API

Registros judiciais (CourtListener) e documentos corporativos (SEC EDGAR) foram avaliados, mas não incluídos: as correspondências de texto integral são excessivamente ruidosas para atribuição confiável. Jurisprudência da UE e relatórios nacionais de má conduta (UK QAA, DFG da Alemanha) são fontes manuais previstas no roteiro.
Fontes de dados e qualidade — Estatísticas de Plágio