Plaģiāta pārbaude pētniekiem pirms iesniegšanas
Pirms iesniegšanas manuskripta pārbaude pret vairāk nekā 700 milj. zinātnisko darbu. My Folders seko Jūsu jau publicētajiem darbiem, lai godīgas pašcitācijas nepalielina rezultātu. ES datu apstrādes punkts pieejams jutīgiem pirms-publicēšanas pētījumiem. Apache 2.0 dzinējs — IRB-revidējams.
Četras pētniecības lomas. Viena pašpārbaudes plūsma.
Disertācijas nodaļas pārbaude pirms iesniegšanas
Pārskatiet vairākas nodaļas. Sekoiet pašcitācijām dažādās versijās.
- Pārbaude katrai nodaļai + versiju vēsture
- Pašcitēšanas atļauju saraksts (Jūsu ORCID + DOI saraksts)
- Bibliogrāfija automātiski izslēgta
Manuskripts pirms žurnāla iesniegšanas
iThenticate pārbauda iesniegšanas brīdī; mēs — pirms tam.
- 700 milj.+ atvērtā piekļuves zinātnisko datu bāze
- Citēšanas klasifikācija (citēts vs necitēts pārstāstījums)
- Pro ar fiksētu maksu · pārbaudiet bez kredītlimita
Literatūras pārskats + priekšlikuma pārbaude
Iepriekš lietots teksts grantos ir normāli — piedāvājam atpazīt.
- Atpazīst Jūsu publicētos darbus + grantus
- Līdzautoru atļauju saraksts (kolēģu iepriekšējie darbi)
- Klasifikācijas atskaite PDF formātā līdzautoriem
Laboratorijas pirms-publicēšanas kvalitātes kontrole
Pārbaudiet visus laboratorijas manuskriptus vienā rindā.
- Mape katram projektam + katram post-doktorantam
- ES datu apstrāde klīniskajiem / sensitīvajiem datiem
- Apache 2.0 dzinējs — aizstāvams IRB
Trīs soļi pirms manuskripts nonāk žurnālā.
Veiciet atkārtoti. Atrodiet pašcitācijas — lai tās nepalielina Jūsu iThenticate / Crossref rezultātu pie iesniegšanas. Drīzumā arī AI noteikšana — varēsiet pārbaudīt pirms recenzenta jautājumiem.
01 · Draft + atļauju saraksts
Augšupielādējiet nodaļas / manuskripta melnrakstu. Pievienojiet savu ORCID + DOI sarakstu (atļauju saraksts) — Jūsu publicētie darbi tiek atzīmēti kā SELF-CITE, nevis plagiāts. Līdzautoru DOI var pievienot, ja ir kopdarbs; dzinējs atpazīst godīgu tekstu atkārtotu lietojumu.
02 · Palaidiet kaskādi
L1 winnowing → šobrīd tiešsaistes tīmeklī, ar L2 MinHash (v1.1) un L3 vektoru iegultnēm (v1.2) vēlāk. Atklāj burtisku un gandrīz burtisku kopēšanu; pārfrāzējuma noteikšana būs pieejama ar L2 un L3. Citātu klasifikācija atdala citēto materiālu no nepietiekami norādīta pārfrāzējuma. Daudzvalodu atbalsts, detekcija kalibrēta angļu, spāņu, portugāļu, poļu un ukraiņu valodām sākumā, vēlāk tiks pievienotas citas valodas. Vidējais pārbaudes laiks — 47 sekundes uz manuskriptu.
03 · Pārskatiet + atkārtojiet
Atskaitē intervāli sašķiroti pēc kategorijas: SELF-CITE (Jūsu paša darbi, sagaidāms), CITED (citēts ar atsauci, sagaidāms), CITED-PARA (pārstāstīts ar atsauci, mazs svars), UNCITED-PARA (šis jāpārskata), un AI-LIKELY (ar pielāgojumu ESL) drīzumā. Atkārtojams — dzinēja commits + korpusa momentuzņēmums katrā atskaitē.
Sešas zinātniski pieņemama pārstrādes kategorijas — neviena nepazemina Jūsu rezultātu nepelnīti.
Slēgti pārbaudītāji jebkuru sakritību atzīmē kā plagiātu. Pētnieki atkārtoti izmanto tekstu likumīgi bieži. Lūk, kā darbojas Noplag klasifikators.
01 · JŪSU PAŠA IEPRIEKŠĒJIE DARBI
ORCID + DOI atļauju saraksts. Jūsu jau publicētie raksti pārbaudes laikā tiek atzīmēti kā SELF-CITE — nevis plagiāts. Bieži izmanto literatūras apskatos (“kā teikts Chen 2023...”) un grantos, kas balstās uz iepriekšējiem pētījumiem.
02 · KOPA AUTORIZĒTI DARBI
Pievienojiet sadarbības partnera ORCID atļauju sarakstā. Kopautorizētie raksti atzīmējas kā CO-CITE. Noder, ja manuskripts balstās uz koprakstu — metožu sadaļa likumīgi dalīta.
03 · LABORATORIJAS MANTOJUMA TEKSTS
PI-mapē koplietots korpuss: standarta metožu daļas, protokoli, ētikas paziņojumi, kas atkārtojas visos laboratorijas darbos. Atzīmē kā LAB-CITE un izslēdz no rezultāta. IRB apstiprināto tekstu nevajag rakstīt no jauna katrā rakstā.
04 · EMBARGOTIE PREPRINTI
Jūsu pašreiz arodoties preprints (arXiv / bioRxiv) tam pašam manuskriptam. Klasifikators atpazīst preprinta → žurnāla versijas attīstību un atzīmē kā PREPRINT-SELF. Neskaitās rezultātā. Žurnāli, kas nepieļauj preprintus, var pielāgot stingrāku pārbaudi.
05 · ATSAUKTAS ATSAUCES
Crossref Retraction Watch integrācija atzīmē jebkuru intervālu ar atsaucēm uz atsauktiem darbiem. Tas nemaina Jūsu līdzību rezultātu, bet zināt pirms iesniegšanas ir svarīgi. Novērš situāciju “atsauce tika atsaukta pēc manuskripta nodošanas”.
06 · IRB / SENSITĪVIE DATI
ES-datu apstrādes punkts (api.eu.noplag.com) saglabā manuskriptu ES infrastruktūrā. Pilnīga pašuzturēšana iespējama HIPAA / GDPR / pacientu datiem. Apache 2.0 + Docker; netiek sūtīti dati ārpus Jūsu VPC.
Sakārtots pēc projekta. Audita žurnāls pēc datuma.
Grupējiet manuskriptus pēc projekta, laboratorijas gada vai granta cikla. Atkārtojiet pārbaudes vēlāk, izmantojot to pašu dzinēja versiju — atskaites reproducējamas pēc mēnešiem.
Trīs lietas, kas vajadzīgas jutīgam pirms-publicēšanas pētījumam.
Manuskripti nepamet ES infrastruktūru
Pro+ norīkošana uz api.eu.noplag.com. Mitināts ES bāzētajos Hetzner datu centros (Falkenšteina + Helsinki). Aizpildījums, pirkstu nospiedumi, atskaite saglabājas ES. GDPR ievērots pēc noklusējuma; DPA pēc pieprasījuma.
Palaidiet dzinēju savas iestādes ietvaros
Apache 2.0 + Docker compose. Pilna pārbaudes ķēde darbojas tikai Jūsu infrastruktūrā. Saskarne ar Jūsu paša Postgres + Redis; korpusu piegādājam kā indeksējamu kopu. Dati nepamet Jūsu VPC. Pareizā izvēle klīnisko datu, pacientu aprakstu vai konfidenciālu pētījumu gadījumā.
Dzēsiet visus mūsu turētos Jūsu nospiedumus
Viens klikšķis Iestatījumos. 24h laikā dzēšam visus nospiedumus, atskaites, atļauju ierakstus un metadatus, kas glabājas uz Jūsu kontu. GDPR 17. pants ievērots. Pašuzturēšanas lietotājiem tieša datubāzes piekļuve; mākoņa lietotājiem API dzēšanas punkts ir dokumentēts.
Apache 2.0 dzinējs, ko IRB tiešām var pārbaudīt pirms apstiprināšanas.
Iestāžu pētniecības programmatūras pārskatos par plagiāta rīkiem parasti uzdod vienus un tos pašus jautājumus: kur manuskripts nonāk pēc iesniegšanas, ko dara salīdzināšanas algoritms, vai sensitīvie dati jebkad tiek nosūtīti, kāds ir dzēšanas ceļš, un vai var atkārtot precizitātes rādītājus. Slēgtās sistēmās uz šiem jautājumiem atbild pārdošanas zvana laikā. Apache 2.0 gadījumā Jūsu IRB var klonēt repo, palaist dzinēju sandbox režīmā, auditēt datu plūsmu, pārbaudīt dzēšanu end-to-end, un atkārtot F1 rādītājus uz sava testkopas. Nemēģinām samazināt pārbaudes kvalitāti — piedāvājam pārbaudi, ko IRB tiešām var pabeigt. Tāpēc datu biroji, kuri iepriekš atteikuši pieņemt jaunus plagiāta rīkus, izvēlas šo risinājumu.
Lasīt IRB pārbaudes ceļvediTādi jautājumi, kādus uzdod pētniecības biroji.
- Kāpēc līdzības rezultāts mainās, kad pievienoju ORCID + DOI sarakstu?
- Jo dzinējs retroaktīvi klasificē katru intervālu, kas sakrita ar kādu Jūsu atļauju saraksta darbu kā SELF-CITE, nevis UNCITED-PARA. Sakritības nepazūd, bet kļūst citādi atzīmētas. SELF-CITE svars rezultātā gandrīz nulle. Matemātika: ja Jūsu disertācijas nodaļa citē divreiz savu preprintu un vienreiz līdzautora publikāciju, tie ir trīs intervāli, kas no “skaitās” pāriet uz “sagaidāma zinātniskā pārstrāde”.
- Vai dzinējs apmāca modeli uz iesniegtajiem manuskriptiem?
- Nē. Iesniegtais teksts tiek tikai pirkstu nospiedumā (winnowing hash), glabājas Jūsu nomnieka izolētā datubāzē. Teksts pats pēc 30 dienām dzēšas, ja nav ieslēgta pagarināta saglabāšana. AI detektors Binoculars — drīzumā — tiks apmācīts uz publiskām kopām; klientu dati netiek izmantoti. Skaidri noteikts DPA.
- Kā ar manu preprintu arXiv / bioRxiv?
- Ja preprinta DOI ir atļauju sarakstā, sakritības ar to tiek atzīmētas kā PREPRINT-SELF un neskaitās rezultātā. Dzinējs atpazīst, ka žurnāla versija no preprinta ir sagaidāma. Žurnāli, kas nepielaiž preprintus (daži vēl ir), var uzstādīt stingrāku pārbaudi, bet lielākā daļa (Nature, Cell, NEJM, PLOS) preprintus pieņem, un SELF marķējums to respektē.
- Kā AI detektors apstrādās ESL līdzautorus?
- AI satura noteikšana drīzumā — v1.2 izstrādes plānā. Kad būs pieejama, tiks izmantota kalibrācija katrai valodai ar pielāgotu rezultātu ESL gadījumā. Ja leksiskais raksturojums norāda uz ne-dzimto angļu valodu (bieži starptautiskās sadarbībās), rezultāts būs ESL ADJ ar dokumentētu atlikušās kļūdas līmeni, nevis apgalvojums par nulli. Liang u.c. 2023. gada pētījumā naiviem detektoriem FPR bija 61,3% TOEFL esejās; mūsu mazināšanas metodoloģija publicēta /docs/developers/benchmarks. ESL līdzautori netiek nepamatoti atzīmēti.
- Vai varu palaist dzinēju Slurm klasterī masveida pārbaudei?
- Jā — Apache 2.0 + Docker. Palaidiet dzinēja konteineru savos klastera skaitļošanas mezglos; datus ielādējiet no koplietojamās failu sistēmas; atskaites izvadiet kā JSON uz vietu, no kuras jūsu caurule lasa. Noderīgi, lai masveidā pārbaudītu gada laboratorijas rezultātus pret jaunāko korpusa momentuzņēmumu. Paraugs Slurm sbatch skriptam pieejams github.com/NoplagLabs/noplag-engine.
- Kā ar klīniskajiem / pacientu datu manuskriptiem?
- Pilnībā pašuzturiet savā VPC. Nav datu kustības ārpus tīkla. Dzinējam nav vajadzīgs internets indeksētas korpusa pārbaudei (zaudēsiet tikai dzīvo pārbaudi, kas ir izvēles). HIPAA saderīgs izvietojums pie korekta uzstādījuma; Jūsu IT vada, kā jebkuru citu iekšējo pakalpojumu.
- Kā tas atšķiras no iThenticate iesniegšanas brīdī?
- iThenticate pārbauda brīdī, kad manuskripts iesniedz redaktoram — Jums nav iespējas pārbaudīt pirms tam. Noplag ļauj pašpārbaudīt pirms iesniegšanas. Kaskādes funkcija līdzvērtīga atvērtajam saturam (faktiski plašāka pēc Plan-S); šaurāka uz abonētā/patentētā satura, kur iThenticate ir licences. Pašcitāciju uzņemšana ir tas, ko vairums pētnieku meklē, bet iThenticate nesniedz pietiekami.
- Vai ir integrācija ar manuskriptu pārvaldniekiem (Zotero / Mendeley / EndNote)?
- Atļauju saraksts pieņem BibTeX, RIS un tiešo ORCID API. Ievietojiet savu Zotero eksportu vai ielīmējiet ORCID; saraksts uzpildās ar visiem Jūsu DOI dažās sekundēs. Mendeley + EndNote reālā laika sinhronizācija ir v1.2 plānā; šobrīd — eksportējiet un augšupielādējiet.
- Kāda ir daudzvalodu pārklājuma precizitāte pētniecībai ārpus angļu valodas žurnāliem?
- Detekcija kalibrēta angļu, spāņu, portugāļu, poļu un ukraiņu valodām sākumā, vēlāk tiks pievienotas citas valodas. Vislabāk darbojas ar Eiropas valodām (ilga kalibrācijas vēsture). Detekcijas kvalitāte pārbaudīta uz PAN-PC-11; atsevišķu valodu novērtējums ir izstrādes plānā. Īpaši noderīgi Eiropas un Dienvidamerikas akadēmiskajā vidē.
- Kas notiek, ja citēts darbs tiek atsaukts pēc manuskripta nodošanas?
- Crossref Retraction Watch integrācija atzīmē katrā pārbaudē. Ja jau esat iesniedzis, ieteicams informēt redaktoru (daļai žurnālu jānorāda atsaukšana pēc iesniegšanas). Tas nemaina līdzības rezultātu, bet uzzināsiet pirms recenzenta.
Palaidiet nodaļu cauri kaskādei. Skatiet pašcitāciju sadalījumu.
Pievienojiet manuskripta melnrakstu, disertācijas nodaļu vai granta literatūras apskatu. Pievienojiet savu ORCID. Skatiet, kuri intervāli ir SELF-CITE, CITED un UNCITED-PARA, ar AI-LIKELY drīzumā. Līdz 2500 vārdiem bez maksas. ES datu apstrāde Pro+ jutīgam pirms-publicēšanas materiālam.