noplagApache 2.0
Thống kê Đạo văn
Nguồn dữ liệu

Nguồn gốc của các số liệu.

Mọi nguồn đều miễn phí và có giấy phép mở. Dấu chấm thể hiện cách số liệu được tạo ra — đếm từ hồ sơ gốc hoặc tổng hợp từ nguồn đã được kiểm duyệt. Toàn bộ quy trình tính toán có tại trang phương pháp luận.

Tier 1 — high-authority datasets (the rate data)

Retraction events + categorized reasons (the plagiarism numerator).

Free, Crossref-hosted

Monthly snapshots

Publications, ROR-resolved affiliations, disciplines (denominators + the DOI join).

Free, CC0

Real-time

DOI metadata linking retractions to works.

Free API

Continuous

Canonical institution identifiers (the disambiguation backbone).

Free, CC0

Tier 2 — curated sources (the case data + signal)
Weekly

Notable plagiarism cases (Category:Plagiarism controversies, scientific misconduct).

Free, CC-BY-SA

Daily

Global news-volume index + recent coverage (current-events signal).

Free, DOC 2.0 API

Hồ sơ tòa án (CourtListener) và báo cáo doanh nghiệp (SEC EDGAR) đã được đánh giá nhưng không đưa vào: các kết quả trùng khớp toàn văn từ các nguồn này quá nhiễu để xác định chính xác. Án lệ EU và báo cáo sai phạm quốc gia (UK QAA, DFG Đức) là các nguồn thủ công đang nằm trong lộ trình.
Nguồn dữ liệu & chất lượng — Thống kê Đạo văn