Detector de plagio para editoriales prepublicación y auditoría
Revisiones previas para envíos de freelancers, auditoría de sindicación para contenidos republicados y una REST API que su equipo técnico puede integrar en su CMS. El motor de detección es Apache 2.0 — entendible antes de adoptarlo, no después.
Cuatro equipos. Un solo flujo.
Evalúe una propuesta freelance antes de asignar
10 minutos por envío, antes de comprometer el presupuesto de edición.
- Pegue un borrador/propuesta o fragmento, vea versiones publicadas antes
- Probabilidad de AI por párrafo (próximamente), sensible a ESL
- Evite el ida y vuelta sobre “¿es original?”
Revise la fila del día antes de publicar
Análisis masivo de los artículos del día antes de que entren a la cola de publicación.
- Vista de la cola ordenada por similitud + puntuación AI
- Umbrales diferenciados por sección (opinión, noticias, reseñas)
- Registro de auditoría por periodista para el equipo de estándares
Investigue un envío impugnado
Lea el algoritmo, luego los fragmentos coincidentes.
- Reproducibilidad X-Engine-Commit
- Modifique el dictamen con motivo documentado
- Apache 2.0 — es defendible en revisión de correcciones
Audite los socios que le republican
Rastree el estado del canonical-tag en toda la red de sindicación.
- Detección compatible con canonical (ORIGIN / SYND OK / LEAK)
- Informe semanal de diferencias por socio
- Paquete de evidencia para DMCA a pedido
Tres pasos antes de que el artículo entre a la cola de publicación en el CMS.
Integrado en su flujo editorial vía API, ejecutado en lote antes de prensa o por envío único en el panel. Mismo motor, mismo formato de informe, se adapta a su flujo.
01 · Ingreso
El envío llega a su cola CMS — arrastre su .docx / .gdoc / pegue el texto, o el CMS lo envía por webhook. Los metadatos de autor, sección y editor asignado viajan con el documento para el registro de auditoría.
02 · Escanear + clasificar
La cascada analiza contra web abierta + Common Crawl + (opcionalmente) su propio corpus histórico. Clasificación de citas separa citas directas (atribuidas) de paráfrasis no citadas. Probabilidad de AI por párrafo (próximamente), sensible a ESL. Mediana 42s por artículo.
03 · Decidir + publicar
El editor ve: similitud de titulares, desglose por categoría, lista de fuentes ordenable (la señal AI con marca ESL estará pronto). Tres acciones: publicar, devolver con notas, escalar al equipo de estándares. Decisión registrada con commit del motor + instantánea del corpus.
Cuatro CMS, un solo contrato REST.
Conecte Noplag en el CMS que su equipo ya usa. La superficie de la API es la misma — cambia solo la capa de integración (hooks de WordPress, acciones de Ghost, eventos de Drupal o sus propios webhooks).
Plugin oficial del directorio de WordPress.org. Compatible con Gutenberg.
- Caja meta previa en todos los tipos de post
- Resaltado a nivel de bloque en el editor
- Registro de auditoría vía WP REST API
Integración por webhook + consumo de Admin API. Compatible con contenido para miembros.
- Webhook previo se lanza en save_draft
- Política de escaneo por etiqueta y tipo de contenido
- Autohospedaje amigable (Noplag autohospedado + Ghost autohospedado)
Módulo contrib de drupal.org. Adjunta vía Field API.
- Campo de plagio por tipo de contenido
- Integración de flujo con Content Moderation
- Soporte para configuración multi-sitio
Webhooks + OpenAPI 3.0. Para CMS headless, sistemas propios y otros.
- POST /v1/checks desde cualquier hook CMS
- Webhooks firmados con HMAC
- SDKs de Python + Node generados desde el spec OpenAPI
Cola de publicación del día. Ordenable, con registro de auditoría.
Filas por artículo con periodista, sección, similitud, puntuación AI, y acceso al informe resaltado. Ordenable. Apruebe en lote lo seguro, escale el resto.
Vea quién le republica — y si el canonical apunta a usted.
Rastree su red de distribución
Agregue los dominios a los que sindica (Medium, LinkedIn, Substack, su red de socios) como allowlist. Informes semanales devuelven qué socios mantienen el rel=canonical apuntando a usted (ORIGIN), cuál lo omite (fuga SEO), y quién republica sin permiso (SCRAPED).
¿En qué blog falta su firma?
Escaneos mensuales en la web abierta detectan dominios fuera de la allowlist publicando intervalos coincidentes de sus artículos. El resultado incluye una instantánea con marca temporal — evidencia para DMCA fechada al día en que apareció la copia. No presentamos DMCA (eso es legal); le damos el expediente.
Duplicación interna entre sus propias páginas
Análisis por carpeta: deposite su corpus publicado en una carpeta; el motor construye la matriz de similitud entre todos los pares. Detecta 47 páginas ciudad con el mismo párrafo boilerplate — puede anticipar un riesgo para Helpful Content Update antes de que lo haga Google.
Tres políticas que su equipo de estándares pedirá antes de firmar.
Primero: los artículos enviados nunca se usan para entrenar ningún modelo. Ni el nuestro ni el de terceros. El texto enviado se somete a huella digital, se indexa en tu tenant y se elimina tras 30 días salvo que decidas conservarlo. Segundo: el veredicto de AI (próximamente, está en la hoja de ruta) será por párrafo, no por artículo, e irá etiquetado con el commit del motor y la marca de tiempo del snapshot del corpus. Una marca de AI impugnada se podrá reproducir meses después usando el mismo commit. No hay reentrenamiento silencioso. Tercero: Apache 2.0 permite que tu equipo técnico clone github.com/NoplagLabs/noplag-engine, lo ejecute en tu propia infraestructura, audite el flujo de datos y verifique el proceso de supresión de datos de principio a fin. La mayoría de las revisiones institucionales de software antiplagio se atascan en esas tres cuestiones; intentamos responderlas desde el inicio.
Lea la guía para el equipo de estándaresLo que el equipo de estándares realmente pregunta antes de comprar.
- ¿Usarán nuestros artículos para entrenar su modelo de AI?
- No. Los artículos enviados se almacenan solo como huellas (solo hashes winnowing) y se indexan en su base aislada. El texto se elimina tras 30 días salvo retención optativa. El modelo — Binoculars (Hans et al. 2024), próximamente — se entrena en corpus públicos; nunca agregamos contenido de clientes. Explicado en el DPA.
- ¿Cómo sobrevive el dictamen AI por párrafo a una disputa periodística?
- La detección de AI estará disponible próximamente — está en la hoja de ruta de la v1.2, no en el lanzamiento inicial. Cuando se active, cada párrafo marcado llevará el commit del motor y el snapshot del corpus. Si vuelves a analizar el mismo párrafo con ese commit, el veredicto será idéntico. El algoritmo está abierto en github.com/NoplagLabs/noplag-engine (Apache 2.0); puedes consultar el umbral de perplexity y la calibración ajustada para ESL. No ofrecemos un modo de “confía en el resultado”.
- ¿Y freelancers enviando desde mercados con poca conectividad?
- La detección está calibrada para inglés, español, portugués, polaco y ucraniano en el lanzamiento, con más idiomas en desarrollo. La calidad de la detección se evalúa con PAN-PC-11; la evaluación por idioma está en la hoja de ruta. El veredicto de AI ajustado para ESL marca la escritura de hablantes no nativos de inglés como ESL ADJ en vez de LIKELY-AI cuando la firma léxica lo indica.
- ¿Podemos autohospedar dentro de la infraestructura?
- Sí — motor Apache 2.0 + Docker. Todo en su red interna. Use su propio Postgres + Redis; nada sale de su VPC. Útil para redacciones con requisitos de confidencialidad o protección de fuente.
- ¿Se integra con nuestro CMS?
- WordPress (plugin oficial), Ghost (Admin API + webhooks), Drupal (módulo contrib). Para cualquier otro CMS — headless o propio — REST + OpenAPI 3.0 da lo necesario. Su equipo puede montar el hook en menos de un día. Los SDKs Python y Node salen del spec.
- ¿Qué hace la función de auditoría de sindicación?
- Agregue sus dominios de distribución en una allowlist (medium.com/@usted, sus socios). El rastreo semanal informa la salud canonical: ORIGIN (apunta a usted), SYND OK (apunta a usted desde socio), LEAK (falta o apunta a otro — divide SEO), o SCRAPED (copia literal, sin canonical, fuera de allowlist). Los matches SCRAPED incluyen instantánea con sello temporal para DMCA.
- ¿Cómo se tarifica para una redacción de 30 periodistas?
- Premium a $79/mes incluye 5.000 palabras/revisión, 5.000 artículos/mes, API completa + integración CMS. Para operaciones grandes (10.000+ artículos/mes), Enterprise es precio por volumen de corpus + infraestructura dedicada. No hay asientos por periodista; escala el volumen.
- ¿Qué hay de opiniones, sindicación y libros donde el 'reuso' se espera?
- Umbrales por sección (Pro+): ajuste la sensibilidad según noticias, opinión, reseña, o extracto sindicado. Un artículo de opinión citando discurso no debe activar lo mismo que una noticia con frase de competidor. La clasificación de citas separa citas legítimas de reuso incidental.
- ¿Ralentiza la publicación?
- Mediana: 47 segundos por 1.500–4.000 palabras. El hook CMS es asíncrono: dispara en save_draft, el editor ve el dictamen al terminar la revisión. Artículos largos (8.000+ palabras) tardan ~90 segundos y van mejor por tarea previa en vez de síncrona.
- ¿Podemos subir el archivo histórico como corpus privado?
- Sí — en Enterprise. Ingesta masiva de contenido archivado a corpus privado, así el motor compara cada envío con su propio archivo. Detecta autocitas (a veces válidas, a veces no) y reuso intencional bajo nueva firma.
Ejecute un borrador en la cola. Vea el informe por artículo.
Suba un Word, un Google Doc o un artículo exportado de CMS. Obtenga informe por párrafo en 47 segundos. Gratis hasta 2.500 palabras; Pro por volumen; Enterprise para corpus + infraestructura dedicada.