DISERTACIÓNAnálisis de 50,000 palabras · reconoce autocitas

Detector de plagio para tesis doctoral con autocitación

Revise su disertación antes de la defensa. El nivel Premium permite 50,000 palabras en un solo análisis. La autocitación entre capítulos se marca como SELF-CITE (legítimo en este volumen, no se considera alerta). Soporta embargos para capítulos de doctorado cumulativo ya presentados como artículos. Residencia en la UE apta para investigación primaria sensible.

0 / 1,500 words
Hasta 50,000 palabrasAutocitación entre capítulosResidencia UE · IRB-revisable
POR QUÉ LAS DISERTACIONES NECESITAN MANEJO ESPECIAL

Cuatro cosas sobre un documento de 60,000 palabras que una herramienta para ensayos de 1,500 no reconoce.

El clasificador está ajustado para textos académicos largos: autocitación entre capítulos es esperada, exclusión automática de bibliografía es clave, y el informe debe poder reproducirse meses después cuando el tribunal pida revisión.

01 · LONGITUD

Análisis de 50,000 palabras en una pasada

El nivel Premium analiza una disertación típica (60,000–80,000 palabras) en bloques de 50,000 por análisis — normalmente dos análisis cubren toda la tesis. Por capítulos suele ser el flujo durante la redacción. El nivel gratuito (2,500 palabras) cubre solo un fragmento; útil para una revisión rápida, no para toda la tesis.

02 · AUTOCITACIÓN

Se espera su propio trabajo previo

Los doctorados cumulativos incluyen intencionadamente artículos ya publicados como capítulos. Añada su ORCID y lista de DOIs a la permisiva; el motor etiqueta esos intervalos como SELF-CITE y los excluye del porcentaje principal. Igual para fragmentos reutilizados de su tesis de máster o exámenes de calificación.

03 · EXCLUSIÓN DE BIBLIOGRAFÍA

100+ referencias no inflan el resultado

Se excluye automáticamente la lista de referencias (detectada por encabezado y formato). Una disertación puede citar 150–400 fuentes; marcar las referencias aumentaría el porcentaje titular a 18–22% desde el inicio. Aquí no ocurre.

04 · LÍNEA DE TIEMPO MULTIANUAL

Borradores en 3–5 años de escritura

Compromiso del motor y foto del corpus fechados en cada informe. Vuelva a analizar el mismo capítulo con el mismo commit dos años después y el resultado es idéntico. Su revisión de enero 2024 servirá frente al tribunal en octubre 2026 — y el informe sigue siendo auditado meses después.

LA LÍNEA DE REDACCIÓN

Tres hitos. El análisis cambia en cada uno.

La mayoría de los doctorados siguen un arco similar: redacción de capítulos → ensamblaje de toda la tesis → preparación para la defensa. El análisis cumple una función distinta en cada fase.

01

01 · Borradores de capítulos (meses 1–24)

Revise cada capítulo al terminarlo. Detecte el parafraseo sin citar antes de que el supervisor lea el capítulo 2 por tercera vez. Utilice la permisiva (ORCID + DOIs de coautoría) para que la autocitación legítima no infle el resultado. Itere sin agotar créditos por documento — Premium plano permite decenas de revisiones sin coste adicional.

02

02 · Ensamblaje de la tesis completa (meses 24–32)

Corra la tesis completa (Premium: 50,000 palabras por vez; una disertación de 80,000 palabras requiere dos análisis). Exclusión automática de bibliografía. Autocitas entre capítulos detectan fragmentos reescritos en capítulo 5 que aparecieron en capítulo 2 — a veces legítimo, a veces un tema de rastreo de borradores que querría identificar.

03

03 · Preparación para la defensa (meses 33–36)

Repase la versión final con el commit de motor en que se basaron reportes anteriores — resultado exacto. Imprima el informe por intervalos; llévelo a la defensa. Si algún miembro señala que un fragmento coincide con su paper 2022, el informe ya lo muestra como SELF-CITE con el DOI cruzado. Reproducible meses después para cualquier revisión post-defensa.

GESTIÓN DE AUTOPLAGIO

Seis categorías de “reciclaje de texto propio” — ninguna debería causar suspensión en defensa.

Doctorandos reutilizan legítimamente texto de publicaciones anteriores, ponencias, exámenes previos y tesis de máster. El clasificador separa lo esperable de lo que realmente requiere atención.

01 · ARTÍCULOS PROPIOS PUBLICADOS

Sus propios artículos (lista permisiva de ORCID + DOI). Los doctorados cumulativos los incluyen como capítulos — marcados como SELF-CITE y excluidos del resultado principal. El aviso de copyright del artículo puede requerir atribución; el clasificador indica qué partes necesitan la introducción “este capítulo se basa en...”

02 · PONENCIAS EN CONGRESOS

Agregue los DOIs de ponencias (o URLs de ACM/IEEE/ACL) a la permisiva. Común en doctorado — una ponencia origina un capítulo de tesis. Etiquetado como SELF-CITE-CONF; algunas instituciones lo permiten con atribución, otras exigen reescritura. El informe sitúa el reciclaje.

03 · TESIS DE MÁSTER

Incluya la URL de su tesis de máster (repositorio institucional, ProQuest o biblioteca de universidad). Revisiones de literatura pueden traer estructura similar de máster → doctorado. Marcado SELF-CITE-MASTERS; algunas instituciones lo aceptan, otras piden mención explícita en el prefacio.

04 · EXÁMENES DE CALIFICACIÓN / PROPUESTAS

Algunas universidades permiten usar material del examen de calificación o propuesta en la tesis; otras exigen reescribir. El clasificador separa estos fragmentos reciclados y los muestra; la política la define el decano. El motor no decide por usted.

05 · CAPÍTULOS CO-AUTORIZADOS

Algunos doctorados incorporan papers en coautoría como capítulos. Añada el ORCID de colaboradores a la permisiva; intervalos coincidentes etiquetados CO-SELF-CITE. El requisito usual es prefacio donde se detalle la contribución propia (CRediT). El informe resume qué intervalos provienen de trabajo coautor.

06 · RECICLAJE SIN ATRIBUCIÓN

La categoría realmente problemática: fragmentos propios reutilizados sin citar — incluso borradores no publicados. Se cuentan en el resultado principal. El reciclaje propio también requiere declaración; la mayoría de universidades consideran plágio propio sin declarar una falta de integridad, aunque técnicamente sea texto suyo.

EL INFORME DE CAPÍTULO

Así luce un informe de capítulo en la redacción.

Clasificación por párrafo con DOIs origen. El resultado principal cuenta solo las categorías sin atribución. Se puede reproducir con el mismo commit de motor meses después.

DISERTACIÓN · CAPÍTULO 4 · 8,420 palabras · 64 intervalos · permisiva activaCapítulo 4: Aprendizaje estadístico en grafos ruidosos
Titular · 3.2%SELF-CITE · 24%v0.4.2
#INTERVALO · FUENTECLASIFICACIÓN
08
Definimos un grafo ruidoso como un triplete (V, E, p), donde p asigna a cada arista una probabilidad de error independiente.Su paper NeurIPS 2023, §2.1 · ORCID + DOI listada · fuente de capítulo cumulativo
SELF-CITE
12
Los avances recientes en redes neuronales de grafos se han centrado en la estabilidad ante perturbaciones estructurales (Kim et al. 2022).openalex.org/W93b · atribuido + (Kim et al. 2022) presente
PARA·CITED
14
La brecha espectral de Laplaciano controla la difusión de información en la red.Hammond et al. (2011), p.142 — citado hace 4 párrafos, el clasificador reconoce atribución continua
PARA·CITED
19
Adoptamos la convención de que los pesos de arista son no negativos y el grafo es no dirigido.Declaración estándar — coincide con 2,300+ papers sobre teoría de grafos — redacción común
COMMON-KNOWLEDGE
23
La robustez ante errores en etiquetas es esencial para aplicaciones reales de clasificadores semi-supervisados.Paper ACL 2023 de coautor Zhang · permisiva con ORCID de coautor · fuente de capítulo co-autorizado
CO-SELF-CITE
28
El algoritmo converge a un mínimo local en O(n log n) pasos bajo nuestras suposiciones.Su informe técnico no publicado (febrero 2024) — sin permisiva, sin atribuir en esta sección
UNATTRIBUTED
41
Bibliografía — Kim, Hammond, Zhang, y otros 187.Sección de referencias, pp. 240–248
REFS · EXCLUDED
Titular 3.2% = solo sin atribución. SELF-CITE + CO-SELF-CITE + CITED + COMMON + REFS todos excluidos.Motor v0.4.2 · Exportar PDF · Reproducible para defensa
50,000palabras por análisis (Premium)
700M+trabajos académicos indexados
6categorías de autocitación
5idiomas de detección al lanzar
UEresidencia · revisable por IRB
DÓNDE NO COMPETIMOS CON ITHENTICATE

Dos concesiones honestas para doctorandos.

01 · BRECHA PROQUEST

La base de datos de disertaciones que su disciplina espera

iThenticate incluye la base de datos ProQuest (~5M disertaciones US); nosotros no tenemos acceso. Si su comité pide comprobación específica contra otras tesis US, iThenticate cumple con eso. Cubrimos ~700M trabajos académicos abiertos (mayor para artículos, menor para disertaciones antiguas). Concesión honesta.

Lea la comparación con iThenticate
02 · REQUISITOS DE REVISTAS

Cuando la revista exige iThenticate al enviar

Algunas revistas (Nature, Cell, NEJM, Elsevier) emplean iThenticate al enviar usando Crossref Similarity Check. Eso ocurre siempre, sin importar si usó otro antes — no se puede sustituir. Para qué SÍ sirve Noplag: autocotejo iterativo tras cada revisión, donde los créditos de iThenticate ($125/doc) hacen inviable decenas de versiones. Ambos cumplen distinto rol.

Lea la guía de flujo de trabajo
LISTO PARA DEFENSA

Reproducible meses después. Lleve el informe impreso a la defensa.

Cada informe incluye el commit del motor (por ejemplo, v0.4.2) y la marca de tiempo del snapshot del corpus. Si vuelves a analizar el mismo capítulo con ese commit dos años después, el resultado será idéntico: no hay reentrenamiento silencioso ni cambios inesperados en el algoritmo durante la defensa. La clasificación de cada intervalo es verificable: la etiqueta SELF-CITE enlaza al DOI de la fuente; la etiqueta CITED enlaza al párrafo coincidente; la etiqueta UNATTRIBUTED enlaza a la URL original de la fuente. Apache 2.0 en github.com/NoplagLabs/noplag-engine: el tribunal puede revisar la lógica de umbrales, la calibración de IA y las reglas de deduplicación. Los verificadores de plagio privativos no cumplen con esto porque su informe depende del estado del algoritmo el día de la revisión; si el modelo se ha actualizado después, el informe presentado en la defensa puede no ser reproducible. El nuestro sí lo es.

Lea la guía para preparar defensa
LISTA DE DEFENSA DE DISERTACIÓN
ALLOWAgregue lista ORCID + DOI de papers previos · ponencias · tesis de máster · ORCIDs coautores
BIBBibliografía detectada por encabezado + formato. Totalmente excluida. Referencias no inflan el resultado.
CHAPTAnalice por capítulo durante la redacción. Análisis completo en ensamblaje. Final antes de la defensa. El mismo motor, mismo formato de informe.
COMMITCada informe incluye commit de motor + foto del corpus. Reproducible para defensa meses o años después.
EUPunto residenciado en la UE para datos primarios sensibles. Puede autoalojar dentro de su institución si el IRB lo exige.
DOICada intervalo coincide con DOI fuente · URL canónica · fecha de foto. Acceso para revisión de tribunal.
FAQ

Lo que realmente preguntan los doctorandos.

¿Puedo analizar toda la disertación de una vez, o debo trocearla?
El nivel Premium permite hasta 50,000 palabras por análisis. En una disertación típica (60,000-80,000), eso son dos análisis (capítulos 1-4 y 5-8) o cuatro si quiere granularidad por capítulo. Por capítulos durante redacción es lo más común; análisis completo al montar y preparar defensa.
¿Cómo funciona en la práctica la lista de permisividad de autocitación?
Incluya su ORCID en la permisiva; el motor toma su lista de DOIs vía la API pública de ORCID. Añada DOIs concretos manualmente para ponencias / máster / coautoría. Los intervalos coincidentes se etiquetan como SELF-CITE, CO-SELF-CITE o SELF-CITE-MASTERS — excluidos del resultado principal. Así evita discusiones sobre “¿esto no es ya mío?” en la defensa.
¿Y sobre disertaciones en ProQuest? Ustedes no las tienen.
Correcto, concesión honesta. La base de ProQuest (~5M disertaciones US) es de pago y no está en OpenAlex/CORE. Si a su comité le exigen cotejo con disertaciones US, iThenticate sí las incluye. Nosotros cubrimos ~700M trabajos académicos abiertos (más para artículos, menos para tesis antiguas).
¿Se almacena mi borrador o se usa para entrenar IA?
No. Los borradores se almacenan con firmas digitales irreversibles (huellas winnowing) y van a una base de datos aislada por usuario. El texto se elimina a los 30 días salvo que acepte retención (la mayoría sí). Los modelos de detección se entrenan solo con corpus público; no añadimos manuscritos de candidatos. Explicado en el DPA.
Reproducibilidad en defensa — ¿qué implica en la práctica?
Cada informe incluye commit de motor (ej. v0.4.2) y foto fechada del corpus. Si guarda un análisis de enero 2024 y repite en octubre 2026 con v0.4.2, el resultado es idéntico. Cada intervalo es comprobable: SELF-CITE enlaza al DOI, CITED al párrafo fuente, UNATTRIBUTED a la URL. Herramientas de código cerrado fallan aquí porque su informe depende del algoritmo del día.
Tengo datos de pacientes o clasificados. ¿Puedo autoalojar?
Sí. Apache 2.0 + Docker; se ejecuta íntegramente en la red de su institución. Sin tráfico externo. Sirve para investigación clínica, datos IRB, información clasificada, o tesis bajo orden de protección. El motor no requiere internet para corpus indexado; la búsqueda web es opcional.
¿Cómo detectará IA un texto mixto de 60,000 palabras humano/IA?
La detección de IA llegará pronto — está en hoja de ruta, no disponible en lanzamiento. Cuando salga, mostrará probabilidad de IA por párrafo (Binoculars, Hans et al. 2024). El dictamen será por párrafo, no por documento — así, un capítulo generado en Grammarly y reescrito por usted se verá distinto. Se aplicará banda ajustada para ESL según la firma léxica. Metodología abierta; defendible en defensa.
¿Doctorados cumulativos — puedo tener capítulos de papers publicados?
Muchas universidades lo permiten explícitamente (Alemania, Países Bajos, Escandinavia habitual; Reino Unido y EE. UU. en aumento). El copyright del journal suele permitir reutilizar con atribución en la tesis. Añada los DOIs a la permisiva; el motor los etiqueta como SELF-CITE. La política institucional y del journal determina si hace falta reescribir o solo declarar.
¿Y si mi tutor o comité impugna una alerta?
Cada intervalo marcado incluye el DOI de la fuente, la URL canónica, la marca de tiempo del snapshot y el commit del motor. Puedes comparar la fuente original en paralelo y mostrar el razonamiento de la clasificación por intervalo. El motor es Apache 2.0 en github.com/NoplagLabs/noplag-engine: tu comité puede revisar la lógica de umbrales línea por línea. Esto es lo que significa realmente “defendible”: citación de la metodología, veredicto reproducible y algoritmo abierto.
¿Cuánto cuesta durante los 3–5 años de redacción?
Premium $79/mes con análisis ilimitados durante escritura activa; puede pausar y reanudar (las carpetas persisten). La mayoría usa Premium 6–12 meses durante el doctorado de 4 años, pausando los períodos sin escritura. El precio plano importa porque los créditos por análisis (iThenticate $125/documento) costarían miles en cientos de revisiones.

Analice un capítulo. Reproduzca el informe en su defensa.

Pegue un capítulo en Noplag. Añada su ORCID. Verifique la clasificación SELF-CITE, CITED, UNATTRIBUTED. La versión gratuita cubre 2,500 palabras para pruebas rápidas; Premium $79/mes permite 50,000 por análisis para revisión integral.

Detector de plagio para tesis doctoral con autocitación