Cek plagiarisme untuk penerbit pre-publish dan audit
Cek prapublikasi untuk kiriman freelancer, audit sindikasi untuk konten hasil republikasikan, dan REST API yang dapat dipasang tim teknik Anda ke CMS. Mesin deteksi Apache 2.0 — dapat diaudit sebelum adopsi, bukan setelahnya.
Empat meja. Satu alur kerja.
Periksa pitch freelancer sebelum penugasan
10 menit per kiriman, sebelum anggaran penyuntingan dipakai.
- Tempelkan pitch draf / klip, lihat versi yang pernah terbit
- Skor kemungkinan AI per paragraf (segera hadir), sadar ESL
- Lewati bolak-balik tanya “ini orisinil?”
Jalankan antrian hari ini sebelum tayang
Scan massal artikel hari ini sebelum masuk antrian publikasi CMS.
- Tampilan antrian, urutan berdasarkan kemiripan + skor AI
- Ambang per-bagian (opini vs berita vs ulasan)
- Audit trail per reporter untuk meja standar
Selidiki kiriman yang dipermasalahkan
Baca algoritma, lalu baca interval hasil cocokan.
- Reproducibility X-Engine-Commit
- Ganti putusan dengan alasan yang terdokumentasi
- Apache 2.0 — dapat dipertanggungjawabkan saat review halaman koreksi
Audit mitra yang me-republish konten Anda
Pantau kesehatan tag-kanonik di jaringan sindikasi.
- Deteksi sadar-kanonik (ORIGIN / SYND OK / LEAK)
- Laporan selisih mingguan per mitra
- Paket bukti setara DMCA bila diminta
Tiga langkah sebelum artikel masuk antrian publikasi CMS.
Tertanam di alur editorial Anda lewat API, dijalankan massal sebelum tayang, atau satuan via dashboard. Mesin dan bentuk laporan sama, tinggal sesuaikan posisi.
01 · Intake
Kiriman masuk antrian CMS Anda — drag-drop .docx / .gdoc / paste, atau CMS mendorong via webhook. Metadata penulis + bagian + editor yang ditugaskan ikut dokumen untuk audit log.
02 · Scan + klasifikasi
Kaskade berjalan di web terbuka + Common Crawl + (opsional) korpus arsip Anda sendiri. Klasifikasi sitasi pisahkan kutipan langsung (dengan atribusi) dari parafrase tanpa sitasi. Skor kemungkinan AI per paragraf segera hadir, sadar ESL. Median 42 detik per artikel.
03 · Putuskan + publikasikan
Editor melihat: kemiripan judul, perincian per kategori, daftar sumber urut (skor AI + flag ESL segera hadir). Tiga aksi: publikasi, kembalikan dengan catatan, atau eskalasi ke meja standar. Putusan dicatat dengan engine commit + snapshot korpus.
Empat permukaan CMS. Satu kontrak REST.
Pasang Noplag ke CMS yang reporter Anda pakai. API-nya sama — yang berbeda hanya lapisan integrasi (WordPress hooks, Ghost actions, Drupal events, atau webhook Anda sendiri).
Plugin resmi dari WordPress.org Plugins Directory. Kompatibel Gutenberg.
- Meta-box prapublikasi di setiap tipe post
- Highlight blok di editor
- Audit log via WP REST API
Integrasi webhook + konsumen Admin API. Kompatibel konten-anggota.
- Webhook prapublikasi berjalan di save_draft
- Scan per-tag per tipe konten
- Self-host friendly (Noplag self-host + Ghost self-host)
Module kontribusi dari drupal.org. Attach berbasis Field-API.
- Kolom plagiarisme per tipe konten
- Integrasi alur kerja dengan Content Moderation
- Konfigurasi multi-site didukung
Webhook + OpenAPI 3.0 spec. Untuk headless CMS, sistem internal, atau lainnya.
- POST /v1/checks dari hook CMS apapun
- Callback webhook bertanda tangan HMAC
- SDK Python + Node dari OpenAPI spec
Antrian publish hari ini. Urut, audit-log.
Baris per artikel berisi reporter, bagian, kemiripan, skor AI, dan laporan highlight. Urutkan. Approve massal artikel aman, eskalasi sisanya.
Lihat siapa yang me-republish Anda — dan apakah tag-kanonik kembali ke Anda.
Pantau jaringan distribusi Anda
Tambah domain sindikasi (Medium, LinkedIn, Substack, mitra jaringan Anda) ke allowlist. Laporan crawl mingguan memberi tahu mitra mana yang rel=canonical-nya kembali ke Anda (kredit ORIGIN), yang hilang (kebocoran SEO), yang me-repost tanpa izin (SCRAPED).
Di blog siapa byline Anda hilang?
Scan selisih bulanan web terbuka mencari domain di luar allowlist yang mempublikasikan interval teks hasil cocokan dari artikel Anda. Cocokan hadir dengan snapshot bertanggal — bukti untuk DMCA sesuai hari munculnya duplikasi. Kami tidak filing DMCA (itu urusan hukum); kami hanya berikan dokumennya.
Duplikasi internal antar halaman Anda sendiri
Scan pro tingkat folder: unggah korpus artikel terbit Anda ke folder; mesin bangun matriks kemiripan tiap pasang. Deteksi 47 city-page dengan paragraf boilerplate sama — risiko Helpful-Content-Update yang perlu diketahui sebelum Google.
Tiga kebijakan yang ingin meja standar Anda tahu sebelum kontrak pembelian.
Pertama — artikel yang dikirim tidak pernah digunakan untuk melatih model. Baik model kami maupun model pihak lain. Teks yang dikirim hanya dibuat sidik jari, diindeks di tenant Anda, dan dihapus setelah 30 hari kecuali jika Anda memilih untuk menyimpannya. Kedua — hasil deteksi AI (segera hadir, masih dalam roadmap) akan diberikan per paragraf, bukan per artikel, dan diberi label commit engine serta timestamp snapshot korpus. Jika ada penandaan AI yang diperdebatkan, hasilnya akan tetap sama beberapa bulan kemudian selama commit-nya sama. Tidak ada pelatihan ulang diam-diam. Ketiga — lisensi Apache 2.0 memungkinkan tim engineering Anda mengkloning github.com/NoplagLabs/noplag-engine, menjalankannya di infrastruktur sendiri, mengaudit alur data, dan memverifikasi proses penghapusan data secara menyeluruh. Sebagian besar proses pengadaan perangkat lunak pendeteksi plagiarisme di institusi terhenti pada tiga pertanyaan itu; kami mencoba menjawabnya di awal.
Baca panduan meja-standarHal yang benar-benar ditanya meja standar sebelum pembelian.
- Apakah artikel kami akan jadi data latih model AI Anda?
- Tidak. Artikel dikirim hanya di-fingerprint (winnowing hash), diindeks di database tenant terisolasi Anda. Teksnya sendiri dihapus setelah 30 hari kecuali Anda aktifkan retensi. Model AI deteksi — Binoculars-based (Hans et al. 2024), segera hadir di roadmap — akan di-pretrain pada korpus publik; kami tidak menambah konten pelanggan, pernah. Jelas di DPA.
- Bagaimana putusan AI per-paragraf tetap bertahan kalau reporter protes?
- Deteksi AI akan segera tersedia — ada di roadmap v1.2, belum tersedia saat peluncuran. Saat fitur ini dirilis, setiap paragraf yang ditandai akan mencantumkan commit engine dan snapshot korpus. Jalankan ulang paragraf yang sama pada commit tersebut dan hasilnya akan identik. Algoritma terbuka di github.com/NoplagLabs/noplag-engine (Apache 2.0), ambang perplexity dapat dilihat, kalibrasi penyesuaian ESL didokumentasikan. Kami tidak menyediakan mode “percaya skor”.
- Bagaimana dengan freelancer dari negara dengan bandwidth rendah?
- Deteksi dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina saat peluncuran, dengan bahasa lain akan menyusul. Kualitas deteksi diuji menggunakan PAN-PC-11; evaluasi per bahasa ada di roadmap. Hasil deteksi AI yang disesuaikan untuk penulis ESL akan menandai tulisan bahasa Inggris non-native sebagai ESL ADJ, bukan LIKELY-AI, jika ciri leksikalnya sesuai.
- Bisa self-host di infrastruktur newsroom kami?
- Ya — engine Apache 2.0 + Docker. Sepenuhnya di jaringan Anda. Bisa dengan Postgres + Redis Anda sendiri; trafik kiriman tidak keluar VPC Anda. Cocok untuk newsroom dengan kebutuhan perlindungan sumber yang ketat atau kerahasiaan pra-publikasi.
- Bisa integrasi dengan CMS kami?
- WordPress (plugin resmi), Ghost (Admin API + webhook), Drupal (module kontribusi). Selain itu — custom CMS, headless, internal — REST + OpenAPI 3.0 spec membuat tim teknik Anda bisa buat pre-publish hook kurang dari sehari. SDK Python dan Node dari spec.
- Fitur audit sindikasi benar-benar apa?
- Tambah domain distribusi ke allowlist (medium.com/@anda, domain mitra). Laporan crawl mingguan memberi kesehatan tag-kanonik: ORIGIN (link ke Anda), SYND OK (link ke Anda dari mitra), LEAK (kanonik hilang atau ke tempat lain — ranking SEO terbagi), atau SCRAPED (copy verbatim, tidak ada kanonik, domain di luar allowlist). Kategori scraped diberi snapshot bertanggal sebagai bukti DMCA.
- Bagaimana sistem harga untuk newsroom 30 reporter?
- Premium $79/bulan untuk 5.000 kata/cek, 5.000 artikel/bulan, API + CMS penuh. Untuk volume tinggi (10.000+ artikel/bulan), kontrak Enterprise berdasarkan volume korpus + infrastruktur khusus. Tidak pakai seat per-reporter; hanya volume yang dihitung.
- Bagaimana dengan op-ed, sindikasi, dan kutipan buku yang memang 'boleh' reuse?
- Ambang per-bagian di Pro+ — sensivitas beda untuk berita vs op-ed vs ulasan vs kutipan sindikasi. Op-ed mengutip verbatim pidato Dewan seharusnya tak sama dengan berita yang pakai frasa media lain. Proses klasifikasi sitasi pisahkan kutipan sah dari reuse tak sengaja.
- Akan memperlambat pipeline publish kami?
- Median 47 detik/artikel pada pemeriksaan 1.500–4.000 kata. Hook integrasi CMS async — jalan saat save_draft, editor sudah lihat hasil saat selesai proofreading. Fitur panjang (8.000+ kata) sekitar 90 detik, bisa lewat pre-publish job daripada hook langsung.
- Bisa tambah katalog lama jadi korpus privat?
- Bisa — tier Enterprise. Arsip bisa di-bulk-ingest ke korpus tenant-privat, jadi mesin periksa setiap kiriman baru ke katalog lama Anda. Tangkap self-recycling reporter (kadang sah kadang tidak), dan reuse konten lama dengan byline baru.
Jalankan draf ke antrian publish. Lihat tampilan artikel per artikel.
Drop dokumen Word, Google Doc, atau artikel hasil ekspor CMS. Dapatkan laporan per paragraf dalam 47 detik. Gratis hingga 2.500 kata; Pro untuk volume; Enterprise untuk korpus + infrastruktur khusus.