noplagApache 2.0
RISSETPra-submisi · Sadar sitasi mandiri · Residensi UE · Dapat ditinjau IRB

Cek plagiarisme untuk peneliti pra-submisi

Pemeriksaan naskah pra-submisi terhadap 700 juta+ karya ilmiah. Folder Saya menelusuri publikasi Anda sendiri sebelumnya agar sitasi mandiri yang sah tidak meningkatkan skor. Endpoint residensi UE tersedia untuk penelitian pra-publikasi yang sensitif. Mesin Apache 2.0 — dapat ditinjau IRB.

700 juta+ karya ilmiahDaftar putih sitasi mandiriResidensi UE · dapat ditinjau IRB
DIMANAPUN ANDA DALAM PROSES

Empat peran riset. Satu alur pemeriksaan mandiri.

PHD / DOKTORAL

Kapitel disertasi pra-submisi

Iterasi antar kapitel. Telusuri sitasi mandiri di berbagai draft.

  • Pemeriksaan per-kapitel + riwayat versi
  • Daftar putih sitasi mandiri (ORCID + daftar DOI Anda)
  • Bibliografi otomatis dikeluarkan
POST-DOK

Naskah sebelum submisi jurnal

iThenticate berjalan saat submisi; kami berjalan sebelumnya.

  • Indeks ilmiah open-access 700 juta+
  • Klasifikasi sitasi (disitasi vs parafrase tanpa sitasi)
  • Pro tarif tetap · iterasi tanpa biaya kredit per penggunaan
PENULIS HIBAH

Ulasan pustaka + validasi proposal

Mendaur ulang boilerplate hibah sebelumnya itu biasa — tandai saja.

  • Kenali publikasi + hibah Anda sendiri sebelumnya
  • Daftar putih co-author (karya kolaborator)
  • Ekspor laporan klasifikasi ke PDF untuk kolaborator
LAB PI

QA pra-publikasi seluruh lab

Deteksi masalah di seluruh submisi lab dalam satu antrean.

  • Folder per proyek + per postdoc
  • Residensi UE untuk data primer klinis / sensitif
  • Mesin Apache 2.0 — dapat dipertanggungjawabkan di IRB
ALUR PRA-SUBMISI

Tiga langkah sebelum naskah masuk portal jurnal.

Jalankan berulang. Tangkap interval sitasi mandiri agar tidak meningkatkan skor iThenticate / Crossref Anda saat submisi. Putusan deteksi AI segera hadir, agar Anda bisa pratinjau sebelum reviewer 2 mengangkat isu.

01

01 · Draft + daftar putih

Unggah draft kapitel / naskah. Tambahkan ORCID + daftar DOI Anda (daftar putih) — publikasi Anda sendiri sebelumnya akan diberi label SELF-CITE, bukan dianggap plagiarisme. DOI co-author ikut jika Anda berkolaborasi; mesin mengenali daur ulang ilmiah yang sah.

02

02 · Jalankan kaskade

L1 winnowing → live-web saat ini, dengan L2 MinHash (v1.1) dan L3 vector embeddings (v1.2) akan menyusul. Mendeteksi penyalinan kata demi kata dan hampir kata demi kata; deteksi parafrase tersedia di L2 dan L3. Klasifikasi sitasi memisahkan kutipan dari parafrase tanpa sitasi. Mendukung banyak bahasa, dengan deteksi yang dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina pada peluncuran awal, serta penambahan bahasa lain secara bertahap. Waktu median 47 detik per manuskrip.

03

03 · Review + iterasi

Laporan menandai interval per kategori: SELF-CITE (punya sendiri, wajar), CITED (dikutip dengan atribusi, wajar), CITED-PARA (parafrase dengan sitasi, bobot rendah), UNCITED-PARA (ini yang perlu perhatian), dan AI-LIKELY (dengan band ESL) segera hadir. Reproducible — commit mesin + snapshot korpus dicantumkan di setiap laporan.

PENGELOLAAN SITASI MANDIRI

Enam kategori daur ulang ilmiah sah — tidak boleh meningkatkan skor Anda.

Checker kotak hitam menandai setiap teks yang cocok sebagai plagiarisme. Peneliti sering mendaur ulang teks secara sah. Berikut cara classifier menangani kasus tersebut.

01 · KARYA ANDA SENDIRI

Daftar putih ORCID + DOI. Karya Anda yang sudah dipublikasikan diberi label SELF-CITE saat cocok — bukan dianggap plagiarisme. Sering terjadi di literatur review (“sebagaimana saya bahas di Chen 2023…”) dan proposal hibah berbasis publikasi sendiri.

02 · KARYA KOLABORASI

Tambahkan ORCID kolaborator ke daftar putih. Karya co-author diberi label CO-CITE. Berguna saat naskah Anda berbasis tulisan bersama rekan — metode standar memang dibagikan.

03 · TEKS WARISAN LAB

Kumpulan dokumen berbagi PI-folder: metode, protokol lab, pernyataan etika yang muncul berulang antar publikasi lab. Diberi label LAB-CITE dan dikecualikan dari skor. Boilerplate IRB yang sudah disetujui tidak perlu ditulis ulang untuk tiap paper.

04 · PRE-PRINT EMBARGO

Pre-print arXiv / bioRxiv Anda sendiri dari naskah yang ingin Anda submisi kini. Classifier mengenali evolusi pre-print → versi jurnal dan diberi label PREPRINT-SELF. Tidak dihitung di skor. Jurnal yang melarang pre-print bisa diatur penanganan lebih ketat.

05 · SITASI DITARIK

Integrasi Crossref Retraction Watch menandai interval pencocokan yang menyitir paper yang sudah ditarik. Tidak mengubah skor — tapi Anda ingin tahu sebelum submisi. Tangkap masalah “saya sitasi paper yang bulan lalu ditarik” sebelum reviewer 2.

06 · IRB / SENSITIF

Endpoint residensi UE (api.eu.noplag.com) menjaga naskah tetap di infrastruktur UE. Jalankan mesin sepenuhnya di jaringan sendiri untuk manuscript HIPAA / GDPR / data pasien. Apache 2.0 + Docker; tidak ada lalu lintas keluar VPC Anda.

FOLDER SAYA · TAMPILAN LAB

Tersusun per proyek. Audit-trail per tanggal.

Kelompokkan naskah Anda per proyek, tahun lab, atau siklus hibah. Ulangi pengecekan draft terhadap commit mesin yang sama nanti — laporan tetap reproducible berbulan-bulan ke depan.

FOLDER SAYA · Lab Dr. Hirano · CompBio24 naskah · 6 proyek
RESIDENSI UEFolder baru
FOLDERDOKUMENAKTIVITAS TERKINIWILAYAH
Proyek: kohort ekspresi PD-L18 naskahdraft v3 dicek · 2 jam laluUE
Proyek: tinjauan keamanan synthetic-bio5 naskahsiap submisi · kemarinUE
Hibah: pembaruan NIH R01 Y33 naskahliteratur review v2 dicek · 2 hari laluUE
Warisan lab: metode + etika4 dokumen · berbagidaftar putih lab diperbarui · 1 minggu laluUE
Pre-print: arXiv tertunda2 naskahPREPRINT-SELF terlabel · 1 minggu laluUE
Arsip (2022–2024)12 paperreferensi sitasi mandiriUE
Semua folder residensi UE · terenkripsi · commit mesin dapat ditinjau IRB di tiap laporanreproduksibilitas: mesin v0.4.2 aktif
700 juta+karya ilmiah terindeks
5bahasa deteksi saat peluncuran, bertambah
UEendpoint residensi tersedia
Apache2.0 · dapat ditinjau IRB
Crossref+ integrasi Retraction Watch
PERLINDUNGAN DATA

Tiga kebutuhan penelitian pra-publikasi sensitif dari pemeriksa.

01 · RESIDENSI UE

Naskah tidak pernah keluar infrastruktur UE

Pro+ dikonfigurasi di api.eu.noplag.com. Dihosting pada pusat data Hetzner di UE (Falkenstein + Helsinki). Pengiriman, penyimpanan fingerprint, dan laporan tetap di UE. Sesuai GDPR; DPA tersedia sesuai permintaan.

Berguna untuk kolaborasi dengan mitra UE di bawah Horizon Europe.
02 · SELF-HOST

Jalankan mesin di institusi Anda

Apache 2.0 + Docker compose. Pipeline deteksi penuh berjalan di infrastruktur Anda. Bawa Postgres + Redis sendiri; kami kirim korpus sebagai bundle terindeks di Enterprise. Tidak ada lalu lintas keluar VPC Anda. Jawaban tepat untuk data uji klinis, studi kasus pasien, atau penelitian primer sensitif secara komersial.

Pasangkan dengan klaster Slurm dan otentikasi institusi (SAML, LDAP, OIDC).
03 · HAK HAPUS

Hapus setiap fingerprint yang kami simpan untuk Anda

Satu klik di Pengaturan. Dalam 24 jam, setiap fingerprint, laporan, daftar putih, dan metadata yang kami simpan akan dihapus. Sesuai GDPR Artikel 17. Pengguna self-host akses langsung ke database; pengguna cloud menggunakan endpoint API penghapusan yang didokumentasi.

Log penghapusan tetap ada untuk audit kepatuhan.
DAPAT DITINJAU IRB

Mesin Apache 2.0 yang benar-benar bisa IRB tinjau sebelum approve.

Kebanyakan tinjauan perangkat lunak riset institusi untuk alat plagiarisme terhenti pada pertanyaan yang sama: ke mana naskah setelah submisi, apa algoritma pencocokan yang dipakai, apakah ada transmisi data pasien/sensitif, bagaimana jalur hak hapus, dan bisakah akurasi dipublikasikan diulang. Vendor tertutup jawabnya di panggilan penjualan. Apache 2.0: IRB Anda bisa clone repo, jalankan mesin di sandbox, audit data flow, cek hak hapus benar-benar bekerja, ulangi klaim F1 per-bahasa di test set mereka. Kami tidak sekadar minta review lebih cepat — kami minta review yang benar-benar bisa selesai. Karena itu kantor data riset yang biasanya menolak vendor baru plagiarisme, kini menandatangani yang ini.

Baca panduan review IRB
PERTANYAAN IRB, JAWABANNYA
Q1Naskah pergi ke mana? — Postgres UE terisolasi tenant jika pakai endpoint residensi UE. Teks sumber dihapus setelah 30 hari kecuali retention diaktifkan.
Q2Dilatih dari submisi? — Tidak. Naskah yang dikirim tidak pernah digunakan melatih model pendeteksi. Tercantum eksplisit di DPA.
Q3Penanganan data pasien/sensitif? — Jalankan mesin sepenuhnya di jaringan sendiri. Tidak ada lalu lintas keluar VPC Anda. Deployment kompatibel HIPAA.
Q4Tinjauan algoritma? — Apache 2.0 di github.com/NoplagLabs/noplag-engine. Kode dapat dibaca, diaudit, dan direproduksi.
Q5Akses multi-institusi? — Akses role-based per-tenant. Audit log setiap akses. Atau self-host agar data tidak pernah keluar institusi.
Q6Hak hapus? — Satu klik di Pengaturan. 24 jam selesai. Sesuai GDPR Art. 17. Log audit disimpan.
FAQ

Pertanyaan yang sungguh ditanya kantor riset.

Mengapa skor kemiripan berubah saat saya tambahkan daftar ORCID + DOI saya?
Karena mesin mengklasifikasi ulang setiap interval yang cocok dengan paper di daftar putih Anda sebagai SELF-CITE, bukan UNCITED-PARA. Kecocokan tetap ada — cuma labelnya berubah. Interval SELF-CITE berbobot nyaris nol di skor utama. Hitungannya: jika kapitel disertasi mengutip pre-print Anda dua kali, paper co-author sekali, berarti tiga interval yang tadinya 'terhitung' jadi 'daur ulang ilmiah sah'.
Apakah mesin ini melatih dari naskah yang dikirim?
Tidak. Teks dikirim di-fingerprint (hanya hash winnowing — signature tak bisa dibalik) dan disimpan di database terisolasi tenant Anda. Teksnya sendiri dihapus setelah 30 hari kecuali retention diaktifkan. Detektor AI Berbasis Binoculars — segera hadir — dilatih di korpus publik; kami tidak menambah naskah pelanggan ke training set. Tertulis eksplisit di DPA.
Bagaimana dengan pre-print saya di arXiv / bioRxiv?
Jika DOI pre-print Anda ada di daftar putih, kecocokan ke sana diberi label PREPRINT-SELF dan tidak dihitung di skor. Mesin mengenali evolusi dari pre-print ke jurnal wajar. Jurnal yang tegas melarang pre-print bisa dikonfigurasi ketat — tapi kebanyakan jurnal besar (Nature, Cell, NEJM, PLOS) menerima pre-print, dan penandaan SELF di sini sesuai kebijakan mereka.
Detektor AI akan menangani co-author ESL seperti apa?
Deteksi AI akan segera hadir — ada di roadmap v1.2. Saat tersedia, menggunakan kalibrasi per bahasa dengan hasil yang disesuaikan untuk ESL. Jika tanda leksikal menunjukkan bahasa Inggris non-native (umum pada kolaborasi multinasional), hasilnya diberikan sebagai ESL ADJ dengan tingkat kesalahan residual yang terdokumentasi, bukan klaim nol. Studi Liang dkk. 2023 mencatat FPR 61,3% pada esai TOEFL untuk detektor naif; metodologi mitigasi kami dipublikasikan di /docs/developers/benchmarks. Penulis bersama ESL tidak akan terdeteksi secara tidak adil.
Bisa mesin ini dipakai di klaster Slurm untuk batch check?
Ya — Apache 2.0 + Docker. Jalankan container engine di node komputasi klaster Anda; ambil data dari shared filesystem; hasilkan laporan dalam format JSON ke lokasi yang dibaca pipeline Anda. Cocok untuk pemeriksaan batch data laboratorium satu tahun terhadap snapshot korpus terbaru. Contoh skrip Slurm sbatch tersedia di github.com/NoplagLabs/noplag-engine.
Bagaimana dengan manuscript data klinis/pasien?
Self-host di VPC Anda. Tidak ada lalu lintas keluar jaringan. Mesin tidak butuh internet untuk cek ke korpus terindeks (layer verifikasi web-live hilang, tapi itu opsional). Deployment kompatibel HIPAA dengan setup infrastruktur sesuai; IT Anda jalankan seperti layanan internal lain.
Apa bedanya dengan iThenticate saat submisi?
iThenticate berjalan saat submisi, editor Anda yang lihat — tidak bisa iterasi. Noplag adalah pemeriksaan mandiri sebelum submisi. Cascade setara untuk konten open-access (malah lebih luas pasca-Plan-S); lebih sempit untuk konten akademik berbayar/berlangganan yang iThenticate punya lisensi. Penanganan sitasi mandiri ini kebutuhan utama peneliti yang belum dijawab baik oleh iThenticate.
Terintegrasi dengan reference manager saya (Zotero / Mendeley / EndNote)?
Impor daftar putih mendukung BibTeX, RIS, dan API ORCID langsung. Unggah ekspor library Zotero Anda, atau tempel ORCID Anda; semua DOI terisi otomatis. Sinkronisasi real-time dengan Mendeley + EndNote ada di roadmap v1.2; saat ini hanya ekspor.
Bagaimana cakupan multibahasanya untuk publikasi di jurnal non-Inggris?
Deteksi dikalibrasi untuk bahasa Inggris, Spanyol, Portugis, Polandia, dan Ukraina pada peluncuran awal, dengan penambahan bahasa lain secara bertahap. Paling optimal untuk bahasa-bahasa Eropa (riwayat kalibrasi panjang). Kualitas deteksi diuji pada PAN-PC-11; evaluasi per bahasa ada di roadmap. Relevan khususnya untuk konteks akademik Eropa dan Amerika Selatan.
Apa yang terjadi jika paper yang saya sitasi ditarik setelah submisi?
Integrasi Crossref Retraction Watch menandai di tiap pemeriksaan ulang naskah. Kalau sudah disubmisi, Anda sebaiknya kabari editor (beberapa jurnal butuh penanganan eksplisit). Tidak mengubah skor kemiripan, tapi Anda lebih tahu sebelum reviewer 2.

Uji satu kapitel di cascade. Lihat rincian sitasi mandiri.

Unggah draft naskah, kapitel disertasi, atau ulasan literatur hibah. Tambahkan ORCID Anda. Cek interval mana yang SELF-CITE, CITED, dan UNCITED-PARA, serta AI-LIKELY segera hadir. Gratis hingga 2.500 kata. Residensi UE di Pro+ untuk naskah pra-publikasi sensitif.

Cek plagiarisme untuk peneliti pra-submisi