SALA DE REDACCIÓNFlujo editorial · API para CMS · auditoría de sindicación

Detector de plagio para editoriales prepublicación y auditoría

Revisiones previas para envíos de freelancers, auditoría de sindicación para contenidos republicados y una REST API que su equipo técnico puede integrar en su CMS. El motor de detección es Apache 2.0 — entendible antes de adoptarlo, no después.

Flujo de prepublicaciónAuditoría de sindicaciónREST API lista para CMS
PARA QUIENES APRUEBAN LA PUBLICACIÓN

Cuatro equipos. Un solo flujo.

EDITOR

Evalúe una propuesta freelance antes de asignar

10 minutos por envío, antes de comprometer el presupuesto de edición.

  • Pegue un borrador/propuesta o fragmento, vea versiones publicadas antes
  • Probabilidad de AI por párrafo (próximamente), sensible a ESL
  • Evite el ida y vuelta sobre “¿es original?”
EDITOR GESTOR

Revise la fila del día antes de publicar

Análisis masivo de los artículos del día antes de que entren a la cola de publicación.

  • Vista de la cola ordenada por similitud + puntuación AI
  • Umbrales diferenciados por sección (opinión, noticias, reseñas)
  • Registro de auditoría por periodista para el equipo de estándares
EQUIPO DE ESTÁNDARES

Investigue un envío impugnado

Lea el algoritmo, luego los fragmentos coincidentes.

  • Reproducibilidad X-Engine-Commit
  • Modifique el dictamen con motivo documentado
  • Apache 2.0 — es defendible en revisión de correcciones
SINDICACIÓN

Audite los socios que le republican

Rastree el estado del canonical-tag en toda la red de sindicación.

  • Detección compatible con canonical (ORIGIN / SYND OK / LEAK)
  • Informe semanal de diferencias por socio
  • Paquete de evidencia para DMCA a pedido
FLUJO DE PREPUBLICACIÓN

Tres pasos antes de que el artículo entre a la cola de publicación en el CMS.

Integrado en su flujo editorial vía API, ejecutado en lote antes de prensa o por envío único en el panel. Mismo motor, mismo formato de informe, se adapta a su flujo.

01

01 · Ingreso

El envío llega a su cola CMS — arrastre su .docx / .gdoc / pegue el texto, o el CMS lo envía por webhook. Los metadatos de autor, sección y editor asignado viajan con el documento para el registro de auditoría.

02

02 · Escanear + clasificar

La cascada analiza contra web abierta + Common Crawl + (opcionalmente) su propio corpus histórico. Clasificación de citas separa citas directas (atribuidas) de paráfrasis no citadas. Probabilidad de AI por párrafo (próximamente), sensible a ESL. Mediana 42s por artículo.

03

03 · Decidir + publicar

El editor ve: similitud de titulares, desglose por categoría, lista de fuentes ordenable (la señal AI con marca ESL estará pronto). Tres acciones: publicar, devolver con notas, escalar al equipo de estándares. Decisión registrada con commit del motor + instantánea del corpus.

INTEGRACIONES CMS

Cuatro CMS, un solo contrato REST.

Conecte Noplag en el CMS que su equipo ya usa. La superficie de la API es la misma — cambia solo la capa de integración (hooks de WordPress, acciones de Ghost, eventos de Drupal o sus propios webhooks).

WordPress5.5+

Plugin oficial del directorio de WordPress.org. Compatible con Gutenberg.

  • Caja meta previa en todos los tipos de post
  • Resaltado a nivel de bloque en el editor
  • Registro de auditoría vía WP REST API
Ghost4.0+

Integración por webhook + consumo de Admin API. Compatible con contenido para miembros.

  • Webhook previo se lanza en save_draft
  • Política de escaneo por etiqueta y tipo de contenido
  • Autohospedaje amigable (Noplag autohospedado + Ghost autohospedado)
Drupal9+ / 10

Módulo contrib de drupal.org. Adjunta vía Field API.

  • Campo de plagio por tipo de contenido
  • Integración de flujo con Content Moderation
  • Soporte para configuración multi-sitio
PersonalizadoREST

Webhooks + OpenAPI 3.0. Para CMS headless, sistemas propios y otros.

  • POST /v1/checks desde cualquier hook CMS
  • Webhooks firmados con HMAC
  • SDKs de Python + Node generados desde el spec OpenAPI
VISTA EDITORIAL

Cola de publicación del día. Ordenable, con registro de auditoría.

Filas por artículo con periodista, sección, similitud, puntuación AI, y acceso al informe resaltado. Ordenable. Apruebe en lote lo seguro, escale el resto.

COLA DE PUBLICACIÓN · martes, 21 de mayo7 artículos pendientes · 2 escalados
Sección: TodasPublicar todo OK
ARTÍCULOPERIODISTASECCIÓNSIMILITUD% AIDICTAMENACCIÓN
El concejo aprueba nueva ley de zonificación para el centroborrador · 1.840 palabrasMarisol ChenLOCAL6%0.04OKPublicar
Dentro de la reconstrucción: lecciones del fiasco Q1borrador · 1.840 palabrasTobias ReinhartTECNOLOGÍA12%0.08OKPublicar
Cómo la IA cambió nuestra redacción en 18 mesesborrador · 1.840 palabrasPriya AnandOPINIÓN38%0.62RETENERRevisar
Novelas modernistas y la cuestión de la vozborrador · 1.840 palabrasSara BeltranCULTURA22%0.18OKPublicar
Enfrentamiento presupuestario en el Senado estatal — ¿qué sigue?borrador · 1.840 palabrasMarcus AdekunlePOLÍTICA67%0.41ESCALARRevisar
Refugiados climáticos: seguimiento a cinco añosborrador · 1.840 palabrasYuki HiranoCRÓNICA14%0.06OKPublicar
Resultados tech: quién superó, quién fallóborrador · 1.840 palabrasDiego MoralesNEGOCIOS51%0.28RETENERRevisar
7 de 7 mostrado · ordenado por sección y hora de envíoregistro de auditoría: 47 decisiones hoy · 2 escalados
47stiempo medio de revisión por artículo
4integraciones CMS
RESTOpenAPI 3.0 · apto para autohospedaje
0envíos usados en entrenamiento (política)
5idiomas de detección, ampliando
AUDITORÍA DE SINDICACIÓN

Vea quién le republica — y si el canonical apunta a usted.

01 · SALUD DEL CANONICAL

Rastree su red de distribución

Agregue los dominios a los que sindica (Medium, LinkedIn, Substack, su red de socios) como allowlist. Informes semanales devuelven qué socios mantienen el rel=canonical apuntando a usted (ORIGIN), cuál lo omite (fuga SEO), y quién republica sin permiso (SCRAPED).

Detecte la re-publicación por LinkedIn que perdió el canonical porque la plataforma lo eliminó.
02 · DETECCIÓN DE SCRAPERS

¿En qué blog falta su firma?

Escaneos mensuales en la web abierta detectan dominios fuera de la allowlist publicando intervalos coincidentes de sus artículos. El resultado incluye una instantánea con marca temporal — evidencia para DMCA fechada al día en que apareció la copia. No presentamos DMCA (eso es legal); le damos el expediente.

Exporte el expediente como PDF para asesoría legal.
03 · AUDITORÍA DE BOILERPLATE

Duplicación interna entre sus propias páginas

Análisis por carpeta: deposite su corpus publicado en una carpeta; el motor construye la matriz de similitud entre todos los pares. Detecta 47 páginas ciudad con el mismo párrafo boilerplate — puede anticipar un riesgo para Helpful Content Update antes de que lo haga Google.

Ejecute semanalmente; exporte la matriz a CSV.
PRINCIPIOS DE REDACCIÓN

Tres políticas que su equipo de estándares pedirá antes de firmar.

Primero: los artículos enviados nunca se usan para entrenar ningún modelo. Ni el nuestro ni el de terceros. El texto enviado se somete a huella digital, se indexa en tu tenant y se elimina tras 30 días salvo que decidas conservarlo. Segundo: el veredicto de AI (próximamente, está en la hoja de ruta) será por párrafo, no por artículo, e irá etiquetado con el commit del motor y la marca de tiempo del snapshot del corpus. Una marca de AI impugnada se podrá reproducir meses después usando el mismo commit. No hay reentrenamiento silencioso. Tercero: Apache 2.0 permite que tu equipo técnico clone github.com/NoplagLabs/noplag-engine, lo ejecute en tu propia infraestructura, audite el flujo de datos y verifique el proceso de supresión de datos de principio a fin. La mayoría de las revisiones institucionales de software antiplagio se atascan en esas tres cuestiones; intentamos responderlas desde el inicio.

Lea la guía para el equipo de estándares
PREGUNTAS Y RESPUESTAS DE REDACCIÓN
Q1¿El motor aprende de nuestros artículos? — No. Solo se almacena la huella digital; nunca se usa para entrenamiento.
Q2¿Podemos autohospedar? — Sí. Apache 2.0 + Docker. Corre íntegramente en su red.
Q3¿Y la residencia UE? — Pro+ en api.eu.noplag.com. Cumple GDPR por defecto.
Q4¿Informes reproducibles? — Cada revisión marca X-Engine-Commit y un snapshot de corpus. Se puede reproducir meses después.
Q5¿Precios por volumen? — Pro: volumen por artículo. Enterprise: corpus-licencia + infraestructura dedicada.
Q6¿Atribución de fuente? — Cada coincidencia incluye URL de fuente, etiqueta canonical, fecha de snapshot, commit de motor.
FAQ

Lo que el equipo de estándares realmente pregunta antes de comprar.

¿Usarán nuestros artículos para entrenar su modelo de AI?
No. Los artículos enviados se almacenan solo como huellas (solo hashes winnowing) y se indexan en su base aislada. El texto se elimina tras 30 días salvo retención optativa. El modelo — Binoculars (Hans et al. 2024), próximamente — se entrena en corpus públicos; nunca agregamos contenido de clientes. Explicado en el DPA.
¿Cómo sobrevive el dictamen AI por párrafo a una disputa periodística?
La detección de AI estará disponible próximamente — está en la hoja de ruta de la v1.2, no en el lanzamiento inicial. Cuando se active, cada párrafo marcado llevará el commit del motor y el snapshot del corpus. Si vuelves a analizar el mismo párrafo con ese commit, el veredicto será idéntico. El algoritmo está abierto en github.com/NoplagLabs/noplag-engine (Apache 2.0); puedes consultar el umbral de perplexity y la calibración ajustada para ESL. No ofrecemos un modo de “confía en el resultado”.
¿Y freelancers enviando desde mercados con poca conectividad?
La detección está calibrada para inglés, español, portugués, polaco y ucraniano en el lanzamiento, con más idiomas en desarrollo. La calidad de la detección se evalúa con PAN-PC-11; la evaluación por idioma está en la hoja de ruta. El veredicto de AI ajustado para ESL marca la escritura de hablantes no nativos de inglés como ESL ADJ en vez de LIKELY-AI cuando la firma léxica lo indica.
¿Podemos autohospedar dentro de la infraestructura?
Sí — motor Apache 2.0 + Docker. Todo en su red interna. Use su propio Postgres + Redis; nada sale de su VPC. Útil para redacciones con requisitos de confidencialidad o protección de fuente.
¿Se integra con nuestro CMS?
WordPress (plugin oficial), Ghost (Admin API + webhooks), Drupal (módulo contrib). Para cualquier otro CMS — headless o propio — REST + OpenAPI 3.0 da lo necesario. Su equipo puede montar el hook en menos de un día. Los SDKs Python y Node salen del spec.
¿Qué hace la función de auditoría de sindicación?
Agregue sus dominios de distribución en una allowlist (medium.com/@usted, sus socios). El rastreo semanal informa la salud canonical: ORIGIN (apunta a usted), SYND OK (apunta a usted desde socio), LEAK (falta o apunta a otro — divide SEO), o SCRAPED (copia literal, sin canonical, fuera de allowlist). Los matches SCRAPED incluyen instantánea con sello temporal para DMCA.
¿Cómo se tarifica para una redacción de 30 periodistas?
Premium a $79/mes incluye 5.000 palabras/revisión, 5.000 artículos/mes, API completa + integración CMS. Para operaciones grandes (10.000+ artículos/mes), Enterprise es precio por volumen de corpus + infraestructura dedicada. No hay asientos por periodista; escala el volumen.
¿Qué hay de opiniones, sindicación y libros donde el 'reuso' se espera?
Umbrales por sección (Pro+): ajuste la sensibilidad según noticias, opinión, reseña, o extracto sindicado. Un artículo de opinión citando discurso no debe activar lo mismo que una noticia con frase de competidor. La clasificación de citas separa citas legítimas de reuso incidental.
¿Ralentiza la publicación?
Mediana: 47 segundos por 1.500–4.000 palabras. El hook CMS es asíncrono: dispara en save_draft, el editor ve el dictamen al terminar la revisión. Artículos largos (8.000+ palabras) tardan ~90 segundos y van mejor por tarea previa en vez de síncrona.
¿Podemos subir el archivo histórico como corpus privado?
Sí — en Enterprise. Ingesta masiva de contenido archivado a corpus privado, así el motor compara cada envío con su propio archivo. Detecta autocitas (a veces válidas, a veces no) y reuso intencional bajo nueva firma.

Ejecute un borrador en la cola. Vea el informe por artículo.

Suba un Word, un Google Doc o un artículo exportado de CMS. Obtenga informe por párrafo en 47 segundos. Gratis hasta 2.500 palabras; Pro por volumen; Enterprise para corpus + infraestructura dedicada.

Detector de plagio para editoriales prepublicación