Plagiāta statistika
Datu avoti

Datu izcelsme.

Katrs avots ir brīvi pieejams un ar atvērtu licenci. Punkts norāda, kā skaitlis iegūts — saskaitīts no primārajiem ierakstiem vai apkopots no kurētajiem avotiem. Pilns aprēķina apraksts pieejams metodoloģijas lapā.

Tier 1 — high-authority datasets (the rate data)

Retraction events + categorized reasons (the plagiarism numerator).

Free, Crossref-hosted

Monthly snapshots

Publications, ROR-resolved affiliations, disciplines (denominators + the DOI join).

Free, CC0

Real-time

DOI metadata linking retractions to works.

Free API

Continuous

Canonical institution identifiers (the disambiguation backbone).

Free, CC0

Tier 2 — curated sources (the case data + signal)
Weekly

Notable plagiarism cases (Category:Plagiarism controversies, scientific misconduct).

Free, CC-BY-SA

Daily

Global news-volume index + recent coverage (current-events signal).

Free, DOC 2.0 API

Tiesu ieraksti (CourtListener) un uzņēmumu dokumenti (SEC EDGAR) tika izvērtēti, bet netika iekļauti: to pilnteksta sakritības ir pārāk trokšņainas, lai tās varētu droši identificēt. ES judikatūra un nacionālie pārkāpumu ziņojumi (UK QAA, Vācijas DFG) ir manuāli avoti, kas iekļauti attīstības plānā.
Datu avoti un kvalitāte — Plagiāta statistika