Cek plagiarisme untuk peneliti pra-submisi
Pemeriksaan naskah pra-submisi terhadap 700 juta+ karya ilmiah. Folder Saya menelusuri publikasi Anda sendiri sebelumnya agar sitasi mandiri yang sah tidak meningkatkan skor. Endpoint residensi UE tersedia untuk penelitian pra-publikasi yang sensitif. Mesin Apache 2.0 — dapat ditinjau IRB.
Empat peran riset. Satu alur pemeriksaan mandiri.
Kapitel disertasi pra-submisi
Iterasi antar kapitel. Telusuri sitasi mandiri di berbagai draft.
- Pemeriksaan per-kapitel + riwayat versi
- Daftar putih sitasi mandiri (ORCID + daftar DOI Anda)
- Bibliografi otomatis dikeluarkan
Naskah sebelum submisi jurnal
iThenticate berjalan saat submisi; kami berjalan sebelumnya.
- Indeks ilmiah open-access 700 juta+
- Klasifikasi sitasi (disitasi vs parafrase tanpa sitasi)
- Pro tarif tetap · iterasi tanpa biaya kredit per penggunaan
Ulasan pustaka + validasi proposal
Mendaur ulang boilerplate hibah sebelumnya itu biasa — tandai saja.
- Kenali publikasi + hibah Anda sendiri sebelumnya
- Daftar putih co-author (karya kolaborator)
- Ekspor laporan klasifikasi ke PDF untuk kolaborator
QA pra-publikasi seluruh lab
Deteksi masalah di seluruh submisi lab dalam satu antrean.
- Folder per proyek + per postdoc
- Residensi UE untuk data primer klinis / sensitif
- Mesin Apache 2.0 — dapat dipertanggungjawabkan di IRB
Tiga langkah sebelum naskah masuk portal jurnal.
Jalankan berulang. Tangkap interval sitasi mandiri agar tidak meningkatkan skor iThenticate / Crossref Anda saat submisi. Putusan deteksi AI segera hadir, agar Anda bisa pratinjau sebelum reviewer 2 mengangkat isu.
01 · Draft + daftar putih
Unggah draft kapitel / naskah. Tambahkan ORCID + daftar DOI Anda (daftar putih) — publikasi Anda sendiri sebelumnya akan diberi label SELF-CITE, bukan dianggap plagiarisme. DOI co-author ikut jika Anda berkolaborasi; mesin mengenali daur ulang ilmiah yang sah.
02 · Jalankan kaskade
L1 winnowing → live-web saat ini, dengan L2 MinHash (v1.1) dan L3 vector embeddings (v1.2) akan menyusul. Mendeteksi penyalinan kata demi kata dan hampir kata demi kata; deteksi parafrase tersedia di L2 dan L3. Klasifikasi sitasi memisahkan kutipan dari parafrase tanpa sitasi. Mendukung banyak bahasa, dengan deteksi yang dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina pada peluncuran awal, serta penambahan bahasa lain secara bertahap. Waktu median 47 detik per manuskrip.
03 · Review + iterasi
Laporan menandai interval per kategori: SELF-CITE (punya sendiri, wajar), CITED (dikutip dengan atribusi, wajar), CITED-PARA (parafrase dengan sitasi, bobot rendah), UNCITED-PARA (ini yang perlu perhatian), dan AI-LIKELY (dengan band ESL) segera hadir. Reproducible — commit mesin + snapshot korpus dicantumkan di setiap laporan.
Enam kategori daur ulang ilmiah sah — tidak boleh meningkatkan skor Anda.
Checker kotak hitam menandai setiap teks yang cocok sebagai plagiarisme. Peneliti sering mendaur ulang teks secara sah. Berikut cara classifier menangani kasus tersebut.
01 · KARYA ANDA SENDIRI
Daftar putih ORCID + DOI. Karya Anda yang sudah dipublikasikan diberi label SELF-CITE saat cocok — bukan dianggap plagiarisme. Sering terjadi di literatur review (“sebagaimana saya bahas di Chen 2023…”) dan proposal hibah berbasis publikasi sendiri.
02 · KARYA KOLABORASI
Tambahkan ORCID kolaborator ke daftar putih. Karya co-author diberi label CO-CITE. Berguna saat naskah Anda berbasis tulisan bersama rekan — metode standar memang dibagikan.
03 · TEKS WARISAN LAB
Kumpulan dokumen berbagi PI-folder: metode, protokol lab, pernyataan etika yang muncul berulang antar publikasi lab. Diberi label LAB-CITE dan dikecualikan dari skor. Boilerplate IRB yang sudah disetujui tidak perlu ditulis ulang untuk tiap paper.
04 · PRE-PRINT EMBARGO
Pre-print arXiv / bioRxiv Anda sendiri dari naskah yang ingin Anda submisi kini. Classifier mengenali evolusi pre-print → versi jurnal dan diberi label PREPRINT-SELF. Tidak dihitung di skor. Jurnal yang melarang pre-print bisa diatur penanganan lebih ketat.
05 · SITASI DITARIK
Integrasi Crossref Retraction Watch menandai interval pencocokan yang menyitir paper yang sudah ditarik. Tidak mengubah skor — tapi Anda ingin tahu sebelum submisi. Tangkap masalah “saya sitasi paper yang bulan lalu ditarik” sebelum reviewer 2.
06 · IRB / SENSITIF
Endpoint residensi UE (api.eu.noplag.com) menjaga naskah tetap di infrastruktur UE. Jalankan mesin sepenuhnya di jaringan sendiri untuk manuscript HIPAA / GDPR / data pasien. Apache 2.0 + Docker; tidak ada lalu lintas keluar VPC Anda.
Tersusun per proyek. Audit-trail per tanggal.
Kelompokkan naskah Anda per proyek, tahun lab, atau siklus hibah. Ulangi pengecekan draft terhadap commit mesin yang sama nanti — laporan tetap reproducible berbulan-bulan ke depan.
Tiga kebutuhan penelitian pra-publikasi sensitif dari pemeriksa.
Naskah tidak pernah keluar infrastruktur UE
Pro+ dikonfigurasi di api.eu.noplag.com. Dihosting pada pusat data Hetzner di UE (Falkenstein + Helsinki). Pengiriman, penyimpanan fingerprint, dan laporan tetap di UE. Sesuai GDPR; DPA tersedia sesuai permintaan.
Jalankan mesin di institusi Anda
Apache 2.0 + Docker compose. Pipeline deteksi penuh berjalan di infrastruktur Anda. Bawa Postgres + Redis sendiri; kami kirim korpus sebagai bundle terindeks di Enterprise. Tidak ada lalu lintas keluar VPC Anda. Jawaban tepat untuk data uji klinis, studi kasus pasien, atau penelitian primer sensitif secara komersial.
Hapus setiap fingerprint yang kami simpan untuk Anda
Satu klik di Pengaturan. Dalam 24 jam, setiap fingerprint, laporan, daftar putih, dan metadata yang kami simpan akan dihapus. Sesuai GDPR Artikel 17. Pengguna self-host akses langsung ke database; pengguna cloud menggunakan endpoint API penghapusan yang didokumentasi.
Mesin Apache 2.0 yang benar-benar bisa IRB tinjau sebelum approve.
Kebanyakan tinjauan perangkat lunak riset institusi untuk alat plagiarisme terhenti pada pertanyaan yang sama: ke mana naskah setelah submisi, apa algoritma pencocokan yang dipakai, apakah ada transmisi data pasien/sensitif, bagaimana jalur hak hapus, dan bisakah akurasi dipublikasikan diulang. Vendor tertutup jawabnya di panggilan penjualan. Apache 2.0: IRB Anda bisa clone repo, jalankan mesin di sandbox, audit data flow, cek hak hapus benar-benar bekerja, ulangi klaim F1 per-bahasa di test set mereka. Kami tidak sekadar minta review lebih cepat — kami minta review yang benar-benar bisa selesai. Karena itu kantor data riset yang biasanya menolak vendor baru plagiarisme, kini menandatangani yang ini.
Baca panduan review IRBPertanyaan yang sungguh ditanya kantor riset.
- Mengapa skor kemiripan berubah saat saya tambahkan daftar ORCID + DOI saya?
- Karena mesin mengklasifikasi ulang setiap interval yang cocok dengan paper di daftar putih Anda sebagai SELF-CITE, bukan UNCITED-PARA. Kecocokan tetap ada — cuma labelnya berubah. Interval SELF-CITE berbobot nyaris nol di skor utama. Hitungannya: jika kapitel disertasi mengutip pre-print Anda dua kali, paper co-author sekali, berarti tiga interval yang tadinya 'terhitung' jadi 'daur ulang ilmiah sah'.
- Apakah mesin ini melatih dari naskah yang dikirim?
- Tidak. Teks dikirim di-fingerprint (hanya hash winnowing — signature tak bisa dibalik) dan disimpan di database terisolasi tenant Anda. Teksnya sendiri dihapus setelah 30 hari kecuali retention diaktifkan. Detektor AI Berbasis Binoculars — segera hadir — dilatih di korpus publik; kami tidak menambah naskah pelanggan ke training set. Tertulis eksplisit di DPA.
- Bagaimana dengan pre-print saya di arXiv / bioRxiv?
- Jika DOI pre-print Anda ada di daftar putih, kecocokan ke sana diberi label PREPRINT-SELF dan tidak dihitung di skor. Mesin mengenali evolusi dari pre-print ke jurnal wajar. Jurnal yang tegas melarang pre-print bisa dikonfigurasi ketat — tapi kebanyakan jurnal besar (Nature, Cell, NEJM, PLOS) menerima pre-print, dan penandaan SELF di sini sesuai kebijakan mereka.
- Detektor AI akan menangani co-author ESL seperti apa?
- Deteksi AI akan segera hadir — ada di roadmap v1.2. Saat tersedia, menggunakan kalibrasi per bahasa dengan hasil yang disesuaikan untuk ESL. Jika tanda leksikal menunjukkan bahasa Inggris non-native (umum pada kolaborasi multinasional), hasilnya diberikan sebagai ESL ADJ dengan tingkat kesalahan residual yang terdokumentasi, bukan klaim nol. Studi Liang dkk. 2023 mencatat FPR 61,3% pada esai TOEFL untuk detektor naif; metodologi mitigasi kami dipublikasikan di /docs/developers/benchmarks. Penulis bersama ESL tidak akan terdeteksi secara tidak adil.
- Bisa mesin ini dipakai di klaster Slurm untuk batch check?
- Ya — Apache 2.0 + Docker. Jalankan container engine di node komputasi klaster Anda; ambil data dari shared filesystem; hasilkan laporan dalam format JSON ke lokasi yang dibaca pipeline Anda. Cocok untuk pemeriksaan batch data laboratorium satu tahun terhadap snapshot korpus terbaru. Contoh skrip Slurm sbatch tersedia di github.com/NoplagLabs/noplag-engine.
- Bagaimana dengan manuscript data klinis/pasien?
- Self-host di VPC Anda. Tidak ada lalu lintas keluar jaringan. Mesin tidak butuh internet untuk cek ke korpus terindeks (layer verifikasi web-live hilang, tapi itu opsional). Deployment kompatibel HIPAA dengan setup infrastruktur sesuai; IT Anda jalankan seperti layanan internal lain.
- Apa bedanya dengan iThenticate saat submisi?
- iThenticate berjalan saat submisi, editor Anda yang lihat — tidak bisa iterasi. Noplag adalah pemeriksaan mandiri sebelum submisi. Cascade setara untuk konten open-access (malah lebih luas pasca-Plan-S); lebih sempit untuk konten akademik berbayar/berlangganan yang iThenticate punya lisensi. Penanganan sitasi mandiri ini kebutuhan utama peneliti yang belum dijawab baik oleh iThenticate.
- Terintegrasi dengan reference manager saya (Zotero / Mendeley / EndNote)?
- Impor daftar putih mendukung BibTeX, RIS, dan API ORCID langsung. Unggah ekspor library Zotero Anda, atau tempel ORCID Anda; semua DOI terisi otomatis. Sinkronisasi real-time dengan Mendeley + EndNote ada di roadmap v1.2; saat ini hanya ekspor.
- Bagaimana cakupan multibahasanya untuk publikasi di jurnal non-Inggris?
- Deteksi dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina pada peluncuran awal, dengan penambahan bahasa lain secara bertahap. Paling optimal untuk bahasa-bahasa Eropa (riwayat kalibrasi panjang). Kualitas deteksi diuji pada PAN-PC-11; evaluasi per bahasa ada di roadmap. Relevan khususnya untuk konteks akademik Eropa dan Amerika Selatan.
- Apa yang terjadi jika paper yang saya sitasi ditarik setelah submisi?
- Integrasi Crossref Retraction Watch menandai di tiap pemeriksaan ulang naskah. Kalau sudah disubmisi, Anda sebaiknya kabari editor (beberapa jurnal butuh penanganan eksplisit). Tidak mengubah skor kemiripan, tapi Anda lebih tahu sebelum reviewer 2.
Uji satu kapitel di cascade. Lihat rincian sitasi mandiri.
Unggah draft naskah, kapitel disertasi, atau ulasan literatur hibah. Tambahkan ORCID Anda. Cek interval mana yang SELF-CITE, CITED, dan UNCITED-PARA, serta AI-LIKELY segera hadir. Gratis hingga 2.500 kata. Residensi UE di Pro+ untuk naskah pra-publikasi sensitif.