noplagApache 2.0
NEWSROOMAlur editorial · API CMS · audit sindikasi

Cek plagiarisme untuk penerbit pre-publish dan audit

Cek prapublikasi untuk kiriman freelancer, audit sindikasi untuk konten hasil republikasikan, dan REST API yang dapat dipasang tim teknik Anda ke CMS. Mesin deteksi Apache 2.0 — dapat diaudit sebelum adopsi, bukan setelahnya.

Alur prapublikasiAudit sindikasiREST API siap CMS
UNTUK YANG BERTANGGUNG JAWAB TERHADAP PUBLIKASI

Empat meja. Satu alur kerja.

EDITOR

Periksa pitch freelancer sebelum penugasan

10 menit per kiriman, sebelum anggaran penyuntingan dipakai.

  • Tempelkan pitch draf / klip, lihat versi yang pernah terbit
  • Skor kemungkinan AI per paragraf (segera hadir), sadar ESL
  • Lewati bolak-balik tanya “ini orisinil?”
MANAGING EDITOR

Jalankan antrian hari ini sebelum tayang

Scan massal artikel hari ini sebelum masuk antrian publikasi CMS.

  • Tampilan antrian, urutan berdasarkan kemiripan + skor AI
  • Ambang per-bagian (opini vs berita vs ulasan)
  • Audit trail per reporter untuk meja standar
MEJA STANDAR

Selidiki kiriman yang dipermasalahkan

Baca algoritma, lalu baca interval hasil cocokan.

  • Reproducibility X-Engine-Commit
  • Ganti putusan dengan alasan yang terdokumentasi
  • Apache 2.0 — dapat dipertanggungjawabkan saat review halaman koreksi
SINDIKASI

Audit mitra yang me-republish konten Anda

Pantau kesehatan tag-kanonik di jaringan sindikasi.

  • Deteksi sadar-kanonik (ORIGIN / SYND OK / LEAK)
  • Laporan selisih mingguan per mitra
  • Paket bukti setara DMCA bila diminta
ALUR KERJA PRAPUBLIKASI

Tiga langkah sebelum artikel masuk antrian publikasi CMS.

Tertanam di alur editorial Anda lewat API, dijalankan massal sebelum tayang, atau satuan via dashboard. Mesin dan bentuk laporan sama, tinggal sesuaikan posisi.

01

01 · Intake

Kiriman masuk antrian CMS Anda — drag-drop .docx / .gdoc / paste, atau CMS mendorong via webhook. Metadata penulis + bagian + editor yang ditugaskan ikut dokumen untuk audit log.

02

02 · Scan + klasifikasi

Kaskade berjalan di web terbuka + Common Crawl + (opsional) korpus arsip Anda sendiri. Klasifikasi sitasi pisahkan kutipan langsung (dengan atribusi) dari parafrase tanpa sitasi. Skor kemungkinan AI per paragraf segera hadir, sadar ESL. Median 42 detik per artikel.

03

03 · Putuskan + publikasikan

Editor melihat: kemiripan judul, perincian per kategori, daftar sumber urut (skor AI + flag ESL segera hadir). Tiga aksi: publikasi, kembalikan dengan catatan, atau eskalasi ke meja standar. Putusan dicatat dengan engine commit + snapshot korpus.

INTEGRASI CMS

Empat permukaan CMS. Satu kontrak REST.

Pasang Noplag ke CMS yang reporter Anda pakai. API-nya sama — yang berbeda hanya lapisan integrasi (WordPress hooks, Ghost actions, Drupal events, atau webhook Anda sendiri).

WordPress5.5+

Plugin resmi dari WordPress.org Plugins Directory. Kompatibel Gutenberg.

  • Meta-box prapublikasi di setiap tipe post
  • Highlight blok di editor
  • Audit log via WP REST API
Ghost4.0+

Integrasi webhook + konsumen Admin API. Kompatibel konten-anggota.

  • Webhook prapublikasi berjalan di save_draft
  • Scan per-tag per tipe konten
  • Self-host friendly (Noplag self-host + Ghost self-host)
Drupal9+ / 10

Module kontribusi dari drupal.org. Attach berbasis Field-API.

  • Kolom plagiarisme per tipe konten
  • Integrasi alur kerja dengan Content Moderation
  • Konfigurasi multi-site didukung
CustomREST

Webhook + OpenAPI 3.0 spec. Untuk headless CMS, sistem internal, atau lainnya.

  • POST /v1/checks dari hook CMS apapun
  • Callback webhook bertanda tangan HMAC
  • SDK Python + Node dari OpenAPI spec
TAMPILAN EDITORIAL

Antrian publish hari ini. Urut, audit-log.

Baris per artikel berisi reporter, bagian, kemiripan, skor AI, dan laporan highlight. Urutkan. Approve massal artikel aman, eskalasi sisanya.

PUBLISH QUEUE · Selasa, 21 Mei7 artikel pending · 2 di eskalasi
Bagian: SemuaPublikasikan bulk OK
ARTIKELREPORTERBAGIANKEMIRIPANAI %PUTUSANAKSI
Dewan setujui aturan zoning baru pusat kotadraf · 1.840 kataMarisol ChenLOKAL6%0.04OKPublikasikan
Inside the rebuild: pelajaran dari kekacauan Q1draf · 1.840 kataTobias ReinhartTEKNOLOGI12%0.08OKPublikasikan
Bagaimana AI mengubah newsroom kami dalam 18 bulandraf · 1.840 kataPriya AnandOPINI38%0.62TUNDAUlas
Novel modernis dan pertanyaan soal suaradraf · 1.840 kataSara BeltranBUDAYA22%0.18OKPublikasikan
Anggaran Senat Negara — apa selanjutnyadraf · 1.840 kataMarcus AdekunlePOLITIK67%0.41ESKALASIUlas
Pengungsi iklim: follow-up lima tahundraf · 1.840 kataYuki HiranoFEATURE14%0.06OKPublikasikan
Pendapatan teknologi: siapa lebih baik, siapa tertinggaldraf · 1.840 kataDiego MoralesBISNIS51%0.28TUNDAUlas
7 dari 7 ditampilkan · urut bagian lalu waktu submitaudit log: 47 putusan hari ini · 2 di eskalasi
47dwaktu cek median per artikel
4integrasi CMS
RESTOpenAPI 3.0 · siap self-host
0kiriman yang dijadikan data latih (kebijakan)
5bahasa deteksi, bertambah
AUDIT SINDIKASI

Lihat siapa yang me-republish Anda — dan apakah tag-kanonik kembali ke Anda.

01 · KESEHATAN KANONIKAL

Pantau jaringan distribusi Anda

Tambah domain sindikasi (Medium, LinkedIn, Substack, mitra jaringan Anda) ke allowlist. Laporan crawl mingguan memberi tahu mitra mana yang rel=canonical-nya kembali ke Anda (kredit ORIGIN), yang hilang (kebocoran SEO), yang me-repost tanpa izin (SCRAPED).

Tangkap repost LinkedIn yang kehilangan canonical karena platform menghapusnya.
02 · DETEKSI SCRAPER

Di blog siapa byline Anda hilang?

Scan selisih bulanan web terbuka mencari domain di luar allowlist yang mempublikasikan interval teks hasil cocokan dari artikel Anda. Cocokan hadir dengan snapshot bertanggal — bukti untuk DMCA sesuai hari munculnya duplikasi. Kami tidak filing DMCA (itu urusan hukum); kami hanya berikan dokumennya.

Ekspor paket bukti ke PDF untuk konsultan hukum.
03 · AUDIT BOILERPLATE

Duplikasi internal antar halaman Anda sendiri

Scan pro tingkat folder: unggah korpus artikel terbit Anda ke folder; mesin bangun matriks kemiripan tiap pasang. Deteksi 47 city-page dengan paragraf boilerplate sama — risiko Helpful-Content-Update yang perlu diketahui sebelum Google.

Jalankan mingguan; ekspor matriks ke CSV.
PRINSIP NEWSROOM

Tiga kebijakan yang ingin meja standar Anda tahu sebelum kontrak pembelian.

Pertama — artikel yang dikirim tidak pernah digunakan untuk melatih model. Baik model kami maupun model pihak lain. Teks yang dikirim hanya dibuat sidik jari, diindeks di tenant Anda, dan dihapus setelah 30 hari kecuali jika Anda memilih untuk menyimpannya. Kedua — hasil deteksi AI (segera hadir, masih dalam roadmap) akan diberikan per paragraf, bukan per artikel, dan diberi label commit engine serta timestamp snapshot korpus. Jika ada penandaan AI yang diperdebatkan, hasilnya akan tetap sama beberapa bulan kemudian selama commit-nya sama. Tidak ada pelatihan ulang diam-diam. Ketiga — lisensi Apache 2.0 memungkinkan tim engineering Anda mengkloning github.com/NoplagLabs/noplag-engine, menjalankannya di infrastruktur sendiri, mengaudit alur data, dan memverifikasi proses penghapusan data secara menyeluruh. Sebagian besar proses pengadaan perangkat lunak pendeteksi plagiarisme di institusi terhenti pada tiga pertanyaan itu; kami mencoba menjawabnya di awal.

Baca panduan meja-standar
TANYA JAWAB NEWSROOM
Q1Apakah mesin belajar dari artikel kami? — Tidak. Hanya dibuat fingerprint; tidak pernah jadi data latih.
Q2Bisa self-host? — Ya. Apache 2.0 + Docker. Benar-benar berjalan di jaringan internal.
Q3Bagaimana dengan residensi EU? — Pro+ dijalankan di api.eu.noplag.com. Standar GDPR.
Q4Laporan bisa direproduksi? — Tiap cek stempel X-Engine-Commit dan snapshot korpus. Reproduksinya sama bulan kemudian.
Q5Harga massal? — Pro per-artikel, Enterprise kontrak korpus + infrastruktur khusus.
Q6Atribusi sumber? — Tiap interval hasil cocokan dikirim bersama URL sumber, tag-kanonik, tanggal snapshot, engine commit.
FAQ

Hal yang benar-benar ditanya meja standar sebelum pembelian.

Apakah artikel kami akan jadi data latih model AI Anda?
Tidak. Artikel dikirim hanya di-fingerprint (winnowing hash), diindeks di database tenant terisolasi Anda. Teksnya sendiri dihapus setelah 30 hari kecuali Anda aktifkan retensi. Model AI deteksi — Binoculars-based (Hans et al. 2024), segera hadir di roadmap — akan di-pretrain pada korpus publik; kami tidak menambah konten pelanggan, pernah. Jelas di DPA.
Bagaimana putusan AI per-paragraf tetap bertahan kalau reporter protes?
Deteksi AI akan segera tersedia — ada di roadmap v1.2, belum tersedia saat peluncuran. Saat fitur ini dirilis, setiap paragraf yang ditandai akan mencantumkan commit engine dan snapshot korpus. Jalankan ulang paragraf yang sama pada commit tersebut dan hasilnya akan identik. Algoritma terbuka di github.com/NoplagLabs/noplag-engine (Apache 2.0), ambang perplexity dapat dilihat, kalibrasi penyesuaian ESL didokumentasikan. Kami tidak menyediakan mode “percaya skor”.
Bagaimana dengan freelancer dari negara dengan bandwidth rendah?
Deteksi dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina saat peluncuran, dengan bahasa lain akan menyusul. Kualitas deteksi diuji menggunakan PAN-PC-11; evaluasi per bahasa ada di roadmap. Hasil deteksi AI yang disesuaikan untuk penulis ESL akan menandai tulisan bahasa Inggris non-native sebagai ESL ADJ, bukan LIKELY-AI, jika ciri leksikalnya sesuai.
Bisa self-host di infrastruktur newsroom kami?
Ya — engine Apache 2.0 + Docker. Sepenuhnya di jaringan Anda. Bisa dengan Postgres + Redis Anda sendiri; trafik kiriman tidak keluar VPC Anda. Cocok untuk newsroom dengan kebutuhan perlindungan sumber yang ketat atau kerahasiaan pra-publikasi.
Bisa integrasi dengan CMS kami?
WordPress (plugin resmi), Ghost (Admin API + webhook), Drupal (module kontribusi). Selain itu — custom CMS, headless, internal — REST + OpenAPI 3.0 spec membuat tim teknik Anda bisa buat pre-publish hook kurang dari sehari. SDK Python dan Node dari spec.
Fitur audit sindikasi benar-benar apa?
Tambah domain distribusi ke allowlist (medium.com/@anda, domain mitra). Laporan crawl mingguan memberi kesehatan tag-kanonik: ORIGIN (link ke Anda), SYND OK (link ke Anda dari mitra), LEAK (kanonik hilang atau ke tempat lain — ranking SEO terbagi), atau SCRAPED (copy verbatim, tidak ada kanonik, domain di luar allowlist). Kategori scraped diberi snapshot bertanggal sebagai bukti DMCA.
Bagaimana sistem harga untuk newsroom 30 reporter?
Premium $79/bulan untuk 5.000 kata/cek, 5.000 artikel/bulan, API + CMS penuh. Untuk volume tinggi (10.000+ artikel/bulan), kontrak Enterprise berdasarkan volume korpus + infrastruktur khusus. Tidak pakai seat per-reporter; hanya volume yang dihitung.
Bagaimana dengan op-ed, sindikasi, dan kutipan buku yang memang 'boleh' reuse?
Ambang per-bagian di Pro+ — sensivitas beda untuk berita vs op-ed vs ulasan vs kutipan sindikasi. Op-ed mengutip verbatim pidato Dewan seharusnya tak sama dengan berita yang pakai frasa media lain. Proses klasifikasi sitasi pisahkan kutipan sah dari reuse tak sengaja.
Akan memperlambat pipeline publish kami?
Median 47 detik/artikel pada pemeriksaan 1.500–4.000 kata. Hook integrasi CMS async — jalan saat save_draft, editor sudah lihat hasil saat selesai proofreading. Fitur panjang (8.000+ kata) sekitar 90 detik, bisa lewat pre-publish job daripada hook langsung.
Bisa tambah katalog lama jadi korpus privat?
Bisa — tier Enterprise. Arsip bisa di-bulk-ingest ke korpus tenant-privat, jadi mesin periksa setiap kiriman baru ke katalog lama Anda. Tangkap self-recycling reporter (kadang sah kadang tidak), dan reuse konten lama dengan byline baru.

Jalankan draf ke antrian publish. Lihat tampilan artikel per artikel.

Drop dokumen Word, Google Doc, atau artikel hasil ekspor CMS. Dapatkan laporan per paragraf dalam 47 detik. Gratis hingga 2.500 kata; Pro untuk volume; Enterprise untuk korpus + infrastruktur khusus.

Cek plagiarisme untuk penerbit pre-publish dan audit