Detector de plagio para periodistas pre-publicación
Revise su texto antes de que lo vea el editor. Detecta paráfrasis y fragmentos de comunicados de prensa, con detección de textos generados por IA próximamente. Además: rastree quién está republicando su firma. Gratis hasta 2.500 palabras; API REST para integrar en el CMS de la redacción.
Cuatro flujos para reporteros. Una sola autoverificación.
Publicaciones diarias al cierre
Su editor es el siguiente lector; asegúrese de que esté limpio antes.
- Autoverificación de 30 segundos en un texto de 900 palabras
- Fragmentos de comunicados de prensa marcados automáticamente
- Superposición con teletipos detectada antes de publicar
Largo formato con reaprovechamiento de investigación
Artículos de 5.000 palabras pasan por transcripciones de entrevistas y notas anteriores.
- Autocitas: sus artículos previos marcados como SELF-CITE
- Clasificación de material citado (atribución vs paráfrasis)
- Consciente de embargo: verifica solo material sin embargo
Meses de fuentes en una sola pieza
Detecta citas sin atribución accidental a lo largo del borrador.
- Verificación de atribución de fuentes por párrafo
- Escaneo de carpeta de documentos fuente
- Captura con validez legal cuando su exclusiva se republica
Publicaciones multiplataforma, sin QA interno
Usted es el editor; la autoverificación es su único filtro antes del editor real.
- Verificación apta para móvil en el teléfono (en campo)
- Autoreciclaje entre publicaciones marcado, con lista de permitidos
- El plan gratis cubre un archivo típico de 2.500 palabras
Tres pasos antes de enviar.
Integrado por API en su flujo de edición, o desde el panel una vez. El mismo motor. El mismo informe. Los mismos 47 segundos.
01 · Autoverifique el borrador
Pegue o suba su texto. Agregue su lista de permitidos de historial de firma (sus piezas anteriores, fuentes sindicadas de teletipos). El motor distingue la paráfrasis accidental de su propio trabajo (válido) de la paráfrasis accidental de alguien más (no permitido).
02 · Verifique las fuentes
El informe muestra cada intervalo coincidente con la URL de la fuente, estado de la etiqueta canónica y fecha de la captura. Los fragmentos de comunicados de prensa se marcan como REPRINT (algunos medios permiten citar comunicados literalmente, con atribución; otros no). Clasificación por párrafo de texto generado por IA con ajuste para ESL próximamente.
03 · Decida antes de enviar
Revise la clasificación: citas atribuidas correctamente (excluidas del puntaje de similitud), paráfrasis con cita (bajo peso), paráfrasis sin cita (esa debe corregirse). Cuando esté disponible la detección de IA, los párrafos probablemente generados deberán ser divulgados o reescritos según la política del medio. Cuando esté limpio, envíe. El informe se adjunta como prueba de auditoría.
Seis verificaciones por párrafo antes de publicar.
Cada categoría aparece junto al intervalo coincidente. Marque cuando la atribución sea necesaria según la política de su medio. El estándar es: “¿lo aceptaría un departamento de estándares?”
01 · CITA DIRECTA
Comillas + atribución al hablante en la misma frase. Cuenta como cita y se excluye del puntaje de similitud. Detectado frente a su carpeta de transcripciones si ha subido grabaciones de entrevistas como fuente primaria.
02 · COMUNICADO DE PRENSA
Texto literal igual a un comunicado público. Marcado como REPRINT. Algunos medios permiten citar comunicados con atribución; otros (la mayoría de los diarios de EEUU) exigen reescritura. Configure la política por medio en Ajustes.
03 · TELETIPO
Comparación contra feeds de AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA (plan Premium con suscripción a corpus de teletipos). El texto de teletipo suele poder reescribirse bajo licencia de su medio; el motor confirma la fuente para distinguir lo licenciado de lo copiado.
04 · EMBARGO
Añada materiales embargados a un rango temporal. Detecta coincidencias con etiqueta EMBARGO-OK hasta la fecha, luego vuelve a la clasificación estándar. Útil en periodismo científico donde los embargos son habituales.
05 · GENERADO POR IA (PRÓXIMAMENTE)
Probabilidad por párrafo de que sea de IA, con ajuste para ESL, en desarrollo. Pensado para revisar colaboraciones freelance: ya es común recibir textos generados por IA, y la autoverificación los detectará antes que el segundo editor. Metodología abierta (Binoculars, Hans et al. 2024).
06 · PROPIO ANTERIOR
Lista de permitidos de historial: sus publicaciones previas, su portfolio, enlace de Substack, archivo de Medium. Autoreciclaje marcado como SELF-CITE — habitual en artículos de fondo cuando se reaprovecha historia propia. No aumenta el puntaje de similitud, aunque verá la marca para revisión.
Lo que ve tras 47 segundos en un archivo de 1.500 palabras.
Clasificación por párrafo con URLs de fuente, estado de atribución y acceso al intervalo relevante. Defendible ante un departamento de estándares; reproducible según la versión del motor indicada en el informe.
Tres acciones cuando su exclusiva aparece bajo otra firma.
Ponga su firma como alerta
Pegue su artículo publicado (o lista) en la lista de vigilancia. El escaneo diario detecta cualquier dominio externo (sin permitir) que publique intervalos coincidentes — copias literales, paráfrasis, versiones por IA. La notificación incluye URL infractora, párrafos y fecha/hora de extracción.
Captura HTML con validez legal, con fecha y hash
Cada scrap marcado viene con captura HTML de la página, fechada y firmada con hash. Combínelo con la fecha de publicación (CMS, tweet o Wayback Machine) y tendrá la cadena de prioridad.
Su firma en sindicación legítima
Si sindica en Medium, LinkedIn, Substack u otros, el motor verifica si las etiquetas canónicas remiten a su original. ORIGIN: el SEO se le acredita; LEAK significa ranking dividido. Problema habitual en LinkedIn: eliminan etiqueta canónica por defecto.
Dos funciones que necesita el periodismo pero que los detectores académicos no cubren.
La mayoría de detectores de plagio no fueron hechos para prensa. Marcan teletipo literal como plagio aunque todo diario que use AP lo tenga licenciado — falso positivo que agota en volumen. No detectan robo de firma, porque solo revisan lo que se sube, no el web que lo republica. La suscripción de Noplag para corpus de teletipos (AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA) marca teletipo como WIRE en vez de PLAGIARISMO. El rastreo de firmas revisa el web para ver dónde se ha republicado. Ambos desactivados por defecto: es una capa específica para periodismo, para cuando el detector estándar no alcanza.
Lea la guía de clasificación de teletiposPreguntas reales de periodistas.
- ¿Se almacenan o usan mis borradores para entrenar modelos?
- No. Los borradores se almacenan solo en su base aislada usando huellas digitales (hash no reversible). El texto se purga tras 30 días salvo que opte por conservación. Los modelos de detección (Binoculars) son pre-entrenados con corpus públicos; no sumamos textos de reporteros en ningún entrenamiento. Está explícito en el DPA.
- ¿Cómo funciona la clasificación de teletipo?
- Plan Premium con suscripción a corpus de teletipos (AP, Reuters, AFP, Bloomberg, dpa, Kyodo, PA). Coincidencias literales con feeds marcadas como WIRE — no como PLAGIARISMO — porque cada diario usa el feed bajo licencia. Política configurable: algunos permiten teletipo ilimitado, otros exigen atribución explícita. La clasificación se muestra junto a cada intervalo.
- ¿Qué ocurre con los comunicados de prensa?
- Comparados con el índice público de comunicados (PR Newswire, Business Wire, EurekAlert, PRWeb). Marcados como REPRINT. Algunos medios permiten citas literales con atribución; otros (la mayoría en EEUU) requieren reescritura. Configure su política en Ajustes; el informe indica la acción requerida.
- ¿Cómo será la detección IA para colaboraciones freelance?
- La detección de AI estará disponible próximamente (en la hoja de ruta de la v1.2). Cuando se lance, ofrecerá una probabilidad de AI por párrafo con veredicto ajustado para ESL, diseñada para redacciones que revisan propuestas de colaboradores, ya que los envíos generados por AI son cada vez más frecuentes. El ajuste para ESL es relevante porque los patrones de escritura de personas no nativas en inglés se parecen a las señales de AI (Stanford 2023 reportó 61,3% de falsos positivos en detectores simples); nuestra calibración busca reducir ese porcentaje de forma significativa, y publicaremos la tasa residual cuando la función supere la evaluación.
- ¿Puedo vigilar mis firmas publicadas ante plagios?
- Plan Premium con función de vigilancia de firma. Añada sus piezas a la lista de vigilancia; escaneo diario detecta dominios no permitidos que publican intervalos coincidentes. Cada aviso viene con captura HTML firmada y fechada — prueba para DMCA. Nosotros no enviamos el DMCA (es asunto de su abogado); solo entregamos el dossier.
- ¿Qué pasa con los embargos?
- Agregue materiales embargados a un alcance temporal con fecha de embargo. Se marcan como EMBARGO-OK hasta la fecha, luego pasan a manejo normal. Útil en periodismo científico (NIH/EurekAlert habituales) y parlamentario (transcripciones con embargo).
- ¿Funciona para reportes en otros idiomas?
- La detección está calibrada para inglés, español, portugués, polaco y ucraniano en el lanzamiento, con más idiomas en desarrollo. La calidad de detección se evalúa con PAN-PC-11; la evaluación por idioma está en la hoja de ruta. Útil para corresponsales internacionales que presentan textos en varios idiomas.
- ¿Cómo es la API para integración con CMS de redacciones?
- REST + especificación OpenAPI 3.0. Los SDK de Python y Node se generan a partir de la especificación. Webhooks para comprobaciones asíncronas en textos extensos. POST /v1/checks desde el hook de tu CMS en save_draft; el informe se adjunta al artículo como metadato de auditoría. Integraciones de ejemplo para WordPress, Ghost y Drupal en github.com/NoplagLabs/noplag-engine.
- ¿Y si soy freelance sin redacción detrás?
- El plan gratis cubre 2.500 palabras por chequeo, sin límite de uso ni registro. Funciona en móvil (puede chequear desde el campo). Premium cuesta $79/mes con clasificación de teletipo, vigilancia de firma y funciones de carpeta. Servidor propio es Apache 2.0 gratis si quiere todo local.
- ¿Qué si una cita resulta generada por IA?
- Cuando llegue la detección IA (próximamente), la probabilidad por párrafo mostrará los sospechosos con ajuste ESL. Si una cita atribuida resulta potencialmente IA, es una alerta editorial: pudo ser la fuente con IA, una paráfrasis de IA o un falso positivo. Es señal para verificar la cita, no descalificación automática.
Revíselo antes que el editor.
Pegue su texto. Reciba informe por párrafo en 47 segundos: citas, teletipos, autocitas, con IA próximamente. Hasta 2.500 palabras gratis. Premium para corpus de teletipos y vigilancia de firma.