Plagiatkontroll för forskare inför inlämning
Manuskriptgranskning före inlämning mot 700M+ vetenskapliga publikationer. Mina mappar spårar dina egna publikationer så att giltig egencitering inte höjer resultatet. EU-residens tillgängligt för känsliga forskningsutkast. Apache 2.0-motor — IRB-granskbar.
Fyra forskarroll. En egenkontrollsprocess.
Disputationskapitel före inlämning
Upprepa mellan kapitel. Spåra egencitering över versioner.
- Granska per kapitel + versionshistorik
- Egenciteringsallowlist (ditt ORCID + DOI-lista)
- Bibliografi auto-exkluderas
Manuskript före journalsinlämning
iThenticate körs vid inlämning; vi kör innan dess.
- 700M+ open-access-index
- Citationsklassificering (citerad vs ej citerad parafras)
- Fast Pro-pris · ingen per-kreditkostnad för iteration
Litteraturgenomgång + förslagsgranskning
Återanvändning av gamla bidragstexter är normalt — flaggar det.
- Känner igen dina egna publikationer + bidrag
- Medförfattarallowlist (kollegas tidigare arbete)
- Exportera klassificeringsrapport till PDF för kollegor
Lab-övergripande kvalitetskontroll
Fånga problem i labbets inskick på en plats.
- Mapp per projekt + per postdoc
- EU-residens för kliniska/känsliga data
- Apache 2.0-motor — försvarbar inför IRB
Tre steg innan manuskriptet skickas till tidskriften.
Kör iterativt. Fånga egenciteringar så de inte höjer ditt iThenticate/Crossref-resultat vid inlämning. AI-beslut kommer snart, så De kan granska innan granskare 2 tar upp det.
01 · Utkast + allowlist
Ladda upp utkastet. Lägg till ORCID + DOI:er (allowlist) — din tidigare publicerade text markeras som SELF-CITE, inte plagiat. Medförfattar-DOI inkluderas om ni samarbetat; motorn känner igen giltig återanvändning.
02 · Kör kaskaden
L1 winnowing → live-web idag, med L2 MinHash (v1.1) och L3 vektorembeddingar (v1.2) kommer senare. Upptäcker ordagrann och nästan ordagrann kopiering; täckning av parafrasering tillkommer med L2 och L3. Citatklassificering skiljer citerat material från okällhänvisad parafras. Flerspråkig, med detektering kalibrerad för engelska, spanska, portugisiska, polska och ukrainska vid lansering, fler språk tillkommer. Median 47 sekunder per manuskript.
03 · Granska + iterera
Rapporten delar in träffar: SELF-CITE (ditt eget, väntat), CITED (citerat, väntat), CITED-PARA (parafraserat men citerat, låg vikt), UNCITED-PARA (kräver åtgärd), och AI-LIKELY (med ESL-justering) snart tillgängligt. Reproducerbart — motorcommit + korpus stämplade på varje rapport.
Sex kategorier av giltig textåteranvändning — ingen höjer ditt resultat.
Svarta lådan-kontroller flaggar all textmatchning som plagiat. Forskare återanvänder text ofta och legitimt. Så här hanteras det.
01 · DITT EGET ARBETE
ORCID + DOI-allowlist. Dina tidigare publicerade artiklar markeras SELF-CITE — inte plagiat. Vanligt i litteraturgenomgångar (”som jag diskuterade i Chen 2023…”) och bidrag där De bygger på eget arbete.
02 · MEDFÖRFATTAD TEXT
Lägg till samarbetspartners ORCID i allowlist. Medförfattade artiklar taggas CO-CITE. Bra när manus bygger på gemensam text — till exempel metoddelen.
03 · LABBETSTEXT
PI-mappens korpus: standardmetoder, labbrutiner, etiktexter som återkommer. Taggas LAB-CITE, räknas inte med. IRB-godkänd standardtext behöver inte skrivas om varje gång.
04 · EMBARGOPREPRINTS
Ditt eget arXiv/bioRxiv-preprint av manuskriptet. Klassificeringen känner igen preprint → tidskriftsversion och taggar PREPRINT-SELF. Räknas inte i resultatet. Tidskrifter som inte tillåter preprints kan välja striktare hantering.
05 · TILLBAKADRAGNA CITAT
Crossref Retraction Watch-integration flaggar alla träffintervall som citerar tillbakadragna artiklar. Påverkar inte ditt resultat men visar inför inlämning. Fångar “jag citerade en artikel som drogs in förra månaden”-problemet före granskningen.
06 · IRB / KÄNSLIGT
EU-residensendpoint (api.eu.noplag.com) håller manuskript inom EU. Kör motorn på egen infrastruktur för HIPAA/GDPR/patientdatamanus. Apache 2.0 + Docker; ingen trafik lämnar er VPC.
Organiserat per projekt. Granskningsspår per datum.
Samla manus per projekt, labår eller bidragscykel. Kör om utkast mot samma motorcommit — rapporterna är reproducerbara månader senare.
Tre krav för känslig pre-publiceringsforskning från en kontroll.
Manuskript lämnar aldrig EU
Pro+ levererat på api.eu.noplag.com. Värd på EU-baserade Hetzner-datacenter (Falkenstein + Helsingfors). Inlämning, fingeravtryck och rapport stannar i EU. GDPR som standard; DPA kan fås.
Kör motorn på egen infrastruktur
Apache 2.0 + Docker Compose. Hela kontrollkedjan på er egen hårdvara. Ta in egen Postgres + Redis; vi skickar korpus som indexerbart paket för Enterprise. Ingen trafik lämnar VPC. Bäst för kliniska data, patientfall eller kommersiellt känslig forskning.
Radera alla fingeravtryck vi har
Ett klick i Inställningar. Inom 24 timmar är alla fingeravtryck, rapporter, allowlists och metadata raderade. GDPR Artikel 17. Självhostade har direkt databastillgång; molnet har dokumenterat API för radering.
En Apache 2.0-motor er IRB faktiskt kan granska innan godkännande.
De flesta forskningsmjukvarugranskningar av plagiatverktyg fastnar på samma frågor: var hamnar manus, hur matchas det, skickas patientdata ut, hur raderas allt, kan ni reproducera publicerad träffsäkerhet. Slutna system svarar vid försäljning. Med Apache 2.0 kan er IRB klona repot, köra motorn i sandbox, granska datavägen, verifiera radering, och testa F1-resultat själva. Målet är inte mindre kontroll — utan faktisk genomförd kontroll. Som gjort att forskningsdatakontor som vägrade andra plagiatverktyg nu släpper in denna.
Läs IRB-granskningsguidenDe frågor forskningskontor faktiskt ställer.
- Varför ändras min likhetspoäng när jag lagt in min ORCID + DOI-lista?
- För att motorn klassificerar alla träffar i din allowlist som SELF-CITE istället för UNCITED-PARA. De försvinner inte — bara etiketten ändras. SELF-CITE ges nära noll vikt. Exempel: om avhandlingens kapitel citerar ditt eget preprint två gånger och medförfattarens artikel en gång, räknades det innan, nu är det väntad återanvändning.
- Tränar ni på inskickade manuskript?
- Nej. Texten fingerprintas (bara winnowing-hashar — icke-reversibla signaturer) och lagras i isolerad databas. Själva texten raderas efter 30 dagar om inte lagring valts. Binoculars-AI-kontroll — kommer snart — tränas på publika korpusar; vi lägger inte kundmanus till träningssetet. Klart i DPA.
- Vad händer med mitt preprint på arXiv/bioRxiv?
- Om preprint-DOI finns i listan markeras matchningar som PREPRINT-SELF och räknas inte med. Motorn förstår att preprint → tidskriftsversion är väntat. Tidskrifter som explicit förbjuder preprint (finns några) kan få striktare regelverk — de flesta stora (Nature, Cell, NEJM, PLOS) godkänner och vår taggning speglar det.
- Hur hanterar AI-kontrollen ESL-medförfattare?
- AI-detektering kommer snart — finns på v1.2-roadmapen. Vid lansering används kalibrering per språk med ett ESL-justerat utlåtande. Om den lexikala signaturen tyder på icke-infödd engelska (vanligt i multinationella samarbeten), levereras utlåtandet som ESL ADJ med dokumenterad kvarstående felmarginal istället för ett nollpåstående. Liang et al. 2023 rapporterade 61,3 % FPR på TOEFL-uppsatser för naiva detektorer; vi publicerar vår metod för riskminimering på /docs/developers/benchmarks. ESL-medförfattare flaggas inte felaktigt.
- Kan motorn köras på Slurm-kluster för batchkontroller?
- Ja — Apache 2.0 + Docker. Kör motorn som container på klustrets beräkningsnoder; läs in från ert delade filsystem; exportera rapporter som JSON till valfri plats i er pipeline. Användbart för batchkontroll av ett års laboratorieresultat mot senaste korpusversionen. Exempel på Slurm sbatch-script finns på github.com/NoplagLabs/noplag-engine.
- Hur med manuskript om kliniska/patientdata?
- Kör på egen VPC. Ingen trafik lämnar nätverket. Motorn kräver inte nätanslutning för indexerad korpus (men live-web steget försvinner, det är valfritt). HIPAA-kompatibel installation om infrastrukturen är rätt satt — IT sköter som andra interna tjänster.
- Hur skiljer det sig mot iThenticate vid inlämning?
- iThenticate körs vid inlämning och redaktören ser det — De kan inte iterera. Noplag är egencheck innan det. Kaskaden är likvärdig på open access (bredare numera efter Plan-S); snävare på prenumerations-/betalväggsinnehåll som iThenticate har licens för. Egencitering är det som flest egentligen behöver men iThenticate klarar sämre.
- Integrerar det med referenshanterare (Zotero/Mendeley/EndNote)?
- Allowlist-import stöder BibTeX, RIS och direkt ORCID-API. Släpp in export från Zotero eller klistra in din ORCID; på sekunder fylls listan med DOI:er. Realtidskoppling Mendeley + EndNote är på v1.2-planen; nu är det exportvägen.
- Hur är flerspråkighet för forskning publicerad på andra språk?
- Detektering är kalibrerad för engelska, spanska, portugisiska, polska och ukrainska vid lansering, fler språk tillkommer. Starkast på europeiska språk (lång kalibreringshistorik). Detekteringskvalitet är benchmarkad på PAN-PC-11; språkspecifik utvärdering finns på roadmapen. Särskilt användbart i europeiska och sydamerikanska akademiska sammanhang.
- Vad händer om en citerad artikel dras tillbaka efter inlämning?
- Crossref Retraction Watch-integration flaggar vid varje ny kontroll. Om manus redan är inskickat: kontakta redaktör (vissa tidskrifter kräver åtgärd vid tillbakadragning efter inskick). Påverkar inte likhetspoäng men De får veta det före granskare 2.
Kör ett kapitel i kaskaden. Se egenciteringsuppdelningen.
Släpp in ett manusutkast, kapitel eller bidragsgenomgång. Lägg till ditt ORCID. Se vilka partier som är SELF-CITE, CITED och UNCITED-PARA, AI-LIKELY kommer snart. Max 2500 ord gratis. EU-residens på Pro+ för känsliga arbeten.