Fazemos isso desde 2014.
Doze anos de detecção de plágio. De um apartamento em Kiev a uma sede em San Francisco, passando por uma aceleradora em Nova York, um milhão de verificações e uma reconstrução deliberada. Este é o caminho que a Noplag percorreu — e para onde vai a seguir.
Começamos a Noplag em Kiev em 2014 porque todo verificador de plágio que encontrávamos era só para instituições, caro demais ou uma caixa-preta. Nenhum explicava realmente por que um trecho era marcado.
Criamos uma versão gratuita, liberamos o acesso e aprendemos o que as pessoas realmente precisavam: não só uma pontuação, mas a fonte. Não só um número, mas um histórico de auditoria. Doze anos e uma reconstrução depois, ainda é isso que tentamos entregar.
Doze anos em marcos.
- 2014
Fundada
Noplag lançado como verificador de plágio gratuito de um apartamento em Kiev. Primeira versão checava texto simples via resultados do Google usando um pool de proxies rotativos. Conseguimos os primeiros 100 usuários em três semanas.
- 2015
100.000 verificações · primeiros pilotos institucionais
Três pequenas faculdades nos EUA adotaram a Noplag para trabalhos de alunos. Suporte para envio de .docx e .pdf adicionado. Descobrimos que PDFs escaneados exigem OCR — um problema que seguiríamos corrigindo uma década depois.
- 2016
Pipeline de conversão de documentos
Implementamos a cadeia unoconv + pdf2html para converter qualquer formato de entrada em HTML indexado. Backend de busca full-text Sphinx. A máquina de estados — Upload → Converter → Analisar → Buscar → Relatar — desenhada este ano segue até a v5.0.
- 2017
Cobertura multilíngue
Adicionamos espanhol e português. Descobrimos, via suporte ao cliente, que escritores ESL eram marcados com mais frequência — os primeiros sinais de um problema que o setor só enfrentaria anos depois.
- 2018
Aceleradora EdTech em NY · US$ 200 mil seed
Entramos numa aceleradora de Nova York focada em tecnologia educacional. Levantamos US$ 200.000 em investimento-anjo. Construímos o dashboard React 16, o UX de progresso via WebSocket e a primeira organização de pastas.
- 2019
1.000.000 de verificações · 4.700 usuários gratuitos
Ultrapassamos um milhão de verificações. Usuários gratuitos chegaram a 4.700. Começamos a integrar pagamentos Stripe e PayPal. O código desta época é o legado da v1 da qual nasceu a v5.0.
- 2020
Desenvolvimento ativo pausado
Paramos lançamentos para decidir o próximo passo. O ChatGPT surgiu. Conteúdo gerado por IA virou o tema central. Detecção de plágio sem detectar IA parecia incompleto. Observamos o setor, ouvimos usuários, tomamos notas.
- maio de 2022
Sede transferida para San Francisco
Três meses após a invasão da Ucrânia, um cofundador mudou-se para San Francisco e restabeleceu a sede lá. A equipe de engenharia seguiu operando em Kiev.
- ago 2023
Cofundadores reunidos em San Francisco
O outro cofundador integrou-se à equipe em San Francisco após ser dispensado, por motivos médicos, das Forças Armadas da Ucrânia, onde servia desde 2022. O planejamento da reconstrução começou para valer.
- 2024
Reconstrução começa
Decidimos recomeçar com uma arquitetura orientada a código aberto. Escolhemos Python + FastAPI para o mecanismo, React/Next.js para as interfaces e Apache 2.0 para o núcleo. Apostamos que a transparência auditável será superior ao modelo de caixa-preta na próxima década do mercado.
- 2025
Engine v1 · Layer W · corpus em nuvem
Desenvolveu a cascata de recuperação em quatro camadas (winnowing → MinHash → embeddings → reranqueamento) e implementou a primeira camada, integrando 3 mecanismos de busca e processando Common Crawl mais 8 índices acadêmicos. MinHash (v1.1), embeddings (v1.2) e detecção de conteúdo por AI baseada em Binoculars (v1.2) estão em desenvolvimento.
- 2026
Lançamento v5.0
ATIVONoplag retorna. Engine Apache 2.0 no GitHub, área em nuvem em noplag.com, quatro planos, dashboard do zero e o Noplag Database — impressões digitais anônimas que crescem a cada verificação. Estamos aqui.
Três compromissos que não mudam.
Auditável
O motor de detecção é Apache 2.0. Você pode ler o código, fazer fork, rodar em sua infraestrutura. Confiança não exige acreditar só na nossa palavra.
Honesto
Detecção de IA é um sinal, não um veredito. Toda correspondência mostra sua fonte. Autores ESL recebem alertas explícitos. Não declaramos precisão que não conseguimos medir.
Seus
Seus documentos nunca são usados para treinamento. Residência na UE disponível. Direito ao esquecimento acessível num clique. O corpus depende de consentimento.
Um pequeno grupo trabalhando nisso há muito tempo.
Originalmente três engenheiros em Kiev. Hoje, sede em San Francisco. Engenharia e pesquisa na Ucrânia, Polônia e Espanha — e uma bibliotecária em tempo integral focada no corpus acadêmico.
Conheça todosQuer fazer parte do próximo capítulo?
Teste o plano gratuito, acompanhe o motor no GitHub, entre no Discord ou fale sobre Enterprise. Respondemos tudo.