Cómo calculamos estas cifras.
Cada cifra en este sitio es un coeficiente de retractación por plagio: cuántas retractaciones por plagio acumula un país, institución o disciplina, dividido por la cantidad de publicaciones correspondientes. Esta página documenta exactamente cómo se produce cada cifra, el nivel de confianza asignado y los sesgos a considerar al citarla.
Cómo contamos
El numerador proviene de la base de datos de Retraction Watch (alojada por Crossref, ~70 000 registros). Solo se conservan los registros cuya razón corresponde estrictamente al código plagiarism of/in: un hallazgo explícito de plagio, no señales indirectas como “eufemismos de plagio” o duplicación. En 2015–2024 eso representa 1,879 registros distintos.
La asignación de institución y disciplina se realiza a través del DOI del artículo mediante OpenAlex, nunca utilizando el campo de afiliación en texto libre de Retraction Watch. OpenAlex ya ha resuelto las afiliaciones de cada trabajo a identificadores ROR canónicos y ha etiquetado su disciplina, por lo que una consulta por DOI devuelve la institución y el área correctas. Resolver la cadena de afiliación en texto libre, en cambio, prioriza el departamento y asocia fragmentos con la institución incorrecta, lo que genera atribuciones erróneas que prohibimos expresamente.
Aproximadamente el 91% de los registros de plagio tienen DOI; cerca del 90% de esos se vinculan a una institución ROR, por lo que alrededor de cuatro de cada cinco registros se atribuyen a una institución canónica.
Cómo normalizamos
Los recuentos absolutos pueden inducir a error: los sistemas de investigación con mayor producción acumulan más retractaciones simplemente porque publican más. Por recuento absoluto, China lidera con 564; por tasa, se sitúa en 7.0 por 100 000. Por ello, informamos tasas, y el sistema está diseñado para que no pueda clasificar entidades por recuento absoluto.
Calidad de la fuente, en cada cifra
Cada estadística está etiquetada según su método de obtención, para que pueda valorarla antes de citarla.
Direct measurement
Counted from primary records (Retraction Watch).
Curated aggregate
Compiled from multiple primary sources.
Modeled / inferred
Statistical extrapolation with stated confidence.
Survey-based
Self-reported, with sampling limitations.
Sesgos y limitaciones conocidos
Reprodúzcalo usted mismo
Todo el proceso consiste en dos llamadas HTTP gratuitas, sin clave, más una unión. Sin claves de API ni niveles de pago.
# 1. Base de datos de Retraction Watch (~65MB CSV) curl "https://api.labs.crossref.org/data/retractionwatch?mailto=YOU@example.com" \ -o retraction_watch.csv # 2. Publicaciones de OpenAlex por país, 2015–2024 (el denominador) curl "https://api.openalex.org/works?filter=publication_year:2015-2024\ &group_by=authorships.institutions.country_code&per-page=200&mailto=YOU@example.com" # 3. Conservar los registros con motivo estricto de 'plagio de/en', atribuir mediante DOI, # dividir por publicaciones, ×100 000. Intervalo de Wilson para el IC.
La implementación de referencia se encuentra en la canalización stats/ del proyecto.