Como calculamos estes números.
Cada valor apresentado neste site corresponde ao coeficiente de retratação por plágio: o número de retratações de publicações por plágio atribuídas a um país, instituição ou área, dividido pelo total de publicações desse mesmo grupo. Esta página documenta exatamente como cada número é produzido, o grau de confiança atribuído e os vieses que devem ser considerados ao citá-lo.
Como contamos
O numerador é obtido a partir do banco de dados Retraction Watch (hospedado pela Crossref, cerca de 70.000 registros). Consideramos apenas registros cujo motivo apresenta o código estrito plagiarism of/in — uma constatação explícita de plágio, excluindo sinais menos claros como "eufemismos para plágio" ou duplicação. Em 2015–2024, isso corresponde a 1,879 registros distintos.
A atribuição por instituição e área é feita pelo cruzamento do DOI do artigo via OpenAlex — nunca pelo campo de afiliação em texto livre do Retraction Watch. O OpenAlex já resolve as afiliações de cada trabalho para identificadores ROR canônicos e classifica a área, de modo que a consulta pelo DOI retorna a instituição e área corretas. Resolver a afiliação a partir do texto livre geralmente prioriza o departamento e associa fragmentos à instituição errada — uma atribuição incorreta que explicitamente evitamos.
Cerca de 91% dos registros de plágio possuem DOI; aproximadamente 90% destes são associados a uma instituição ROR, então cerca de quatro em cada cinco registros são atribuídos a uma instituição canônica.
Como normalizamos
Contagens absolutas podem ser enganosas: sistemas de pesquisa com alta produção acumulam mais retratações simplesmente porque publicam mais. Pela contagem absoluta, China lidera com 564; pela taxa, está em 7.0 por 100 mil. Por isso, reportamos taxas, e o sistema foi projetado para não classificar entidades por contagem absoluta.
Qualidade da fonte, em cada número
Cada estatística é identificada conforme seu método de produção, permitindo avaliar sua confiabilidade antes de citar.
Direct measurement
Counted from primary records (Retraction Watch).
Curated aggregate
Compiled from multiple primary sources.
Modeled / inferred
Statistical extrapolation with stated confidence.
Survey-based
Self-reported, with sampling limitations.
Vieses e limitações conhecidos
Reproduza você mesmo
Todo o fluxo consiste em duas chamadas HTTP gratuitas, sem chave, mais um join. Sem chaves de API, sem níveis pagos.
# 1. Base de dados Retraction Watch (~65MB CSV) curl "https://api.labs.crossref.org/data/retractionwatch?mailto=YOU@example.com" \ -o retraction_watch.csv # 2. Publicações do OpenAlex por país, 2015–2024 (o denominador) curl "https://api.openalex.org/works?filter=publication_year:2015-2024\ &group_by=authorships.institutions.country_code&per-page=200&mailto=YOU@example.com" # 3. Mantenha apenas registros com motivo estrito de 'plágio de/em', atribua via DOI, # divida pelo número de publicações, ×100.000. Intervalo de Wilson para o intervalo de confiança.
A implementação de referência está no pipeline stats/ do projeto.