Detector de plagio para tesis doctoral con autocitación
Revise su disertación antes de la defensa. El nivel Premium permite 50,000 palabras en un solo análisis. La autocitación entre capítulos se marca como SELF-CITE (legítimo en este volumen, no se considera alerta). Soporta embargos para capítulos de doctorado cumulativo ya presentados como artículos. Residencia en la UE apta para investigación primaria sensible.
Cuatro cosas sobre un documento de 60,000 palabras que una herramienta para ensayos de 1,500 no reconoce.
El clasificador está ajustado para textos académicos largos: autocitación entre capítulos es esperada, exclusión automática de bibliografía es clave, y el informe debe poder reproducirse meses después cuando el tribunal pida revisión.
Análisis de 50,000 palabras en una pasada
El nivel Premium analiza una disertación típica (60,000–80,000 palabras) en bloques de 50,000 por análisis — normalmente dos análisis cubren toda la tesis. Por capítulos suele ser el flujo durante la redacción. El nivel gratuito (2,500 palabras) cubre solo un fragmento; útil para una revisión rápida, no para toda la tesis.
Se espera su propio trabajo previo
Los doctorados cumulativos incluyen intencionadamente artículos ya publicados como capítulos. Añada su ORCID y lista de DOIs a la permisiva; el motor etiqueta esos intervalos como SELF-CITE y los excluye del porcentaje principal. Igual para fragmentos reutilizados de su tesis de máster o exámenes de calificación.
100+ referencias no inflan el resultado
Se excluye automáticamente la lista de referencias (detectada por encabezado y formato). Una disertación puede citar 150–400 fuentes; marcar las referencias aumentaría el porcentaje titular a 18–22% desde el inicio. Aquí no ocurre.
Borradores en 3–5 años de escritura
Compromiso del motor y foto del corpus fechados en cada informe. Vuelva a analizar el mismo capítulo con el mismo commit dos años después y el resultado es idéntico. Su revisión de enero 2024 servirá frente al tribunal en octubre 2026 — y el informe sigue siendo auditado meses después.
Tres hitos. El análisis cambia en cada uno.
La mayoría de los doctorados siguen un arco similar: redacción de capítulos → ensamblaje de toda la tesis → preparación para la defensa. El análisis cumple una función distinta en cada fase.
01 · Borradores de capítulos (meses 1–24)
Revise cada capítulo al terminarlo. Detecte el parafraseo sin citar antes de que el supervisor lea el capítulo 2 por tercera vez. Utilice la permisiva (ORCID + DOIs de coautoría) para que la autocitación legítima no infle el resultado. Itere sin agotar créditos por documento — Premium plano permite decenas de revisiones sin coste adicional.
02 · Ensamblaje de la tesis completa (meses 24–32)
Corra la tesis completa (Premium: 50,000 palabras por vez; una disertación de 80,000 palabras requiere dos análisis). Exclusión automática de bibliografía. Autocitas entre capítulos detectan fragmentos reescritos en capítulo 5 que aparecieron en capítulo 2 — a veces legítimo, a veces un tema de rastreo de borradores que querría identificar.
03 · Preparación para la defensa (meses 33–36)
Repase la versión final con el commit de motor en que se basaron reportes anteriores — resultado exacto. Imprima el informe por intervalos; llévelo a la defensa. Si algún miembro señala que un fragmento coincide con su paper 2022, el informe ya lo muestra como SELF-CITE con el DOI cruzado. Reproducible meses después para cualquier revisión post-defensa.
Seis categorías de “reciclaje de texto propio” — ninguna debería causar suspensión en defensa.
Doctorandos reutilizan legítimamente texto de publicaciones anteriores, ponencias, exámenes previos y tesis de máster. El clasificador separa lo esperable de lo que realmente requiere atención.
01 · ARTÍCULOS PROPIOS PUBLICADOS
Sus propios artículos (lista permisiva de ORCID + DOI). Los doctorados cumulativos los incluyen como capítulos — marcados como SELF-CITE y excluidos del resultado principal. El aviso de copyright del artículo puede requerir atribución; el clasificador indica qué partes necesitan la introducción “este capítulo se basa en...”
02 · PONENCIAS EN CONGRESOS
Agregue los DOIs de ponencias (o URLs de ACM/IEEE/ACL) a la permisiva. Común en doctorado — una ponencia origina un capítulo de tesis. Etiquetado como SELF-CITE-CONF; algunas instituciones lo permiten con atribución, otras exigen reescritura. El informe sitúa el reciclaje.
03 · TESIS DE MÁSTER
Incluya la URL de su tesis de máster (repositorio institucional, ProQuest o biblioteca de universidad). Revisiones de literatura pueden traer estructura similar de máster → doctorado. Marcado SELF-CITE-MASTERS; algunas instituciones lo aceptan, otras piden mención explícita en el prefacio.
04 · EXÁMENES DE CALIFICACIÓN / PROPUESTAS
Algunas universidades permiten usar material del examen de calificación o propuesta en la tesis; otras exigen reescribir. El clasificador separa estos fragmentos reciclados y los muestra; la política la define el decano. El motor no decide por usted.
05 · CAPÍTULOS CO-AUTORIZADOS
Algunos doctorados incorporan papers en coautoría como capítulos. Añada el ORCID de colaboradores a la permisiva; intervalos coincidentes etiquetados CO-SELF-CITE. El requisito usual es prefacio donde se detalle la contribución propia (CRediT). El informe resume qué intervalos provienen de trabajo coautor.
06 · RECICLAJE SIN ATRIBUCIÓN
La categoría realmente problemática: fragmentos propios reutilizados sin citar — incluso borradores no publicados. Se cuentan en el resultado principal. El reciclaje propio también requiere declaración; la mayoría de universidades consideran plágio propio sin declarar una falta de integridad, aunque técnicamente sea texto suyo.
Así luce un informe de capítulo en la redacción.
Clasificación por párrafo con DOIs origen. El resultado principal cuenta solo las categorías sin atribución. Se puede reproducir con el mismo commit de motor meses después.
Dos concesiones honestas para doctorandos.
La base de datos de disertaciones que su disciplina espera
iThenticate incluye la base de datos ProQuest (~5M disertaciones US); nosotros no tenemos acceso. Si su comité pide comprobación específica contra otras tesis US, iThenticate cumple con eso. Cubrimos ~700M trabajos académicos abiertos (mayor para artículos, menor para disertaciones antiguas). Concesión honesta.
Lea la comparación con iThenticateCuando la revista exige iThenticate al enviar
Algunas revistas (Nature, Cell, NEJM, Elsevier) emplean iThenticate al enviar usando Crossref Similarity Check. Eso ocurre siempre, sin importar si usó otro antes — no se puede sustituir. Para qué SÍ sirve Noplag: autocotejo iterativo tras cada revisión, donde los créditos de iThenticate ($125/doc) hacen inviable decenas de versiones. Ambos cumplen distinto rol.
Lea la guía de flujo de trabajoReproducible meses después. Lleve el informe impreso a la defensa.
Cada informe incluye el commit del motor (por ejemplo, v0.4.2) y la marca de tiempo del snapshot del corpus. Si vuelves a analizar el mismo capítulo con ese commit dos años después, el resultado será idéntico: no hay reentrenamiento silencioso ni cambios inesperados en el algoritmo durante la defensa. La clasificación de cada intervalo es verificable: la etiqueta SELF-CITE enlaza al DOI de la fuente; la etiqueta CITED enlaza al párrafo coincidente; la etiqueta UNATTRIBUTED enlaza a la URL original de la fuente. Apache 2.0 en github.com/NoplagLabs/noplag-engine: el tribunal puede revisar la lógica de umbrales, la calibración de IA y las reglas de deduplicación. Los verificadores de plagio privativos no cumplen con esto porque su informe depende del estado del algoritmo el día de la revisión; si el modelo se ha actualizado después, el informe presentado en la defensa puede no ser reproducible. El nuestro sí lo es.
Lea la guía para preparar defensaLo que realmente preguntan los doctorandos.
- ¿Puedo analizar toda la disertación de una vez, o debo trocearla?
- El nivel Premium permite hasta 50,000 palabras por análisis. En una disertación típica (60,000-80,000), eso son dos análisis (capítulos 1-4 y 5-8) o cuatro si quiere granularidad por capítulo. Por capítulos durante redacción es lo más común; análisis completo al montar y preparar defensa.
- ¿Cómo funciona en la práctica la lista de permisividad de autocitación?
- Incluya su ORCID en la permisiva; el motor toma su lista de DOIs vía la API pública de ORCID. Añada DOIs concretos manualmente para ponencias / máster / coautoría. Los intervalos coincidentes se etiquetan como SELF-CITE, CO-SELF-CITE o SELF-CITE-MASTERS — excluidos del resultado principal. Así evita discusiones sobre “¿esto no es ya mío?” en la defensa.
- ¿Y sobre disertaciones en ProQuest? Ustedes no las tienen.
- Correcto, concesión honesta. La base de ProQuest (~5M disertaciones US) es de pago y no está en OpenAlex/CORE. Si a su comité le exigen cotejo con disertaciones US, iThenticate sí las incluye. Nosotros cubrimos ~700M trabajos académicos abiertos (más para artículos, menos para tesis antiguas).
- ¿Se almacena mi borrador o se usa para entrenar IA?
- No. Los borradores se almacenan con firmas digitales irreversibles (huellas winnowing) y van a una base de datos aislada por usuario. El texto se elimina a los 30 días salvo que acepte retención (la mayoría sí). Los modelos de detección se entrenan solo con corpus público; no añadimos manuscritos de candidatos. Explicado en el DPA.
- Reproducibilidad en defensa — ¿qué implica en la práctica?
- Cada informe incluye commit de motor (ej. v0.4.2) y foto fechada del corpus. Si guarda un análisis de enero 2024 y repite en octubre 2026 con v0.4.2, el resultado es idéntico. Cada intervalo es comprobable: SELF-CITE enlaza al DOI, CITED al párrafo fuente, UNATTRIBUTED a la URL. Herramientas de código cerrado fallan aquí porque su informe depende del algoritmo del día.
- Tengo datos de pacientes o clasificados. ¿Puedo autoalojar?
- Sí. Apache 2.0 + Docker; se ejecuta íntegramente en la red de su institución. Sin tráfico externo. Sirve para investigación clínica, datos IRB, información clasificada, o tesis bajo orden de protección. El motor no requiere internet para corpus indexado; la búsqueda web es opcional.
- ¿Cómo detectará IA un texto mixto de 60,000 palabras humano/IA?
- La detección de IA llegará pronto — está en hoja de ruta, no disponible en lanzamiento. Cuando salga, mostrará probabilidad de IA por párrafo (Binoculars, Hans et al. 2024). El dictamen será por párrafo, no por documento — así, un capítulo generado en Grammarly y reescrito por usted se verá distinto. Se aplicará banda ajustada para ESL según la firma léxica. Metodología abierta; defendible en defensa.
- ¿Doctorados cumulativos — puedo tener capítulos de papers publicados?
- Muchas universidades lo permiten explícitamente (Alemania, Países Bajos, Escandinavia habitual; Reino Unido y EE. UU. en aumento). El copyright del journal suele permitir reutilizar con atribución en la tesis. Añada los DOIs a la permisiva; el motor los etiqueta como SELF-CITE. La política institucional y del journal determina si hace falta reescribir o solo declarar.
- ¿Y si mi tutor o comité impugna una alerta?
- Cada intervalo marcado incluye el DOI de la fuente, la URL canónica, la marca de tiempo del snapshot y el commit del motor. Puedes comparar la fuente original en paralelo y mostrar el razonamiento de la clasificación por intervalo. El motor es Apache 2.0 en github.com/NoplagLabs/noplag-engine: tu comité puede revisar la lógica de umbrales línea por línea. Esto es lo que significa realmente “defendible”: citación de la metodología, veredicto reproducible y algoritmo abierto.
- ¿Cuánto cuesta durante los 3–5 años de redacción?
- Premium $79/mes con análisis ilimitados durante escritura activa; puede pausar y reanudar (las carpetas persisten). La mayoría usa Premium 6–12 meses durante el doctorado de 4 años, pausando los períodos sin escritura. El precio plano importa porque los créditos por análisis (iThenticate $125/documento) costarían miles en cientos de revisiones.
Analice un capítulo. Reproduzca el informe en su defensa.
Pegue un capítulo en Noplag. Añada su ORCID. Verifique la clasificación SELF-CITE, CITED, UNATTRIBUTED. La versión gratuita cubre 2,500 palabras para pruebas rápidas; Premium $79/mes permite 50,000 por análisis para revisión integral.