P0곧 출시 — ChatGPT, Claude, Gemini, GPT-5, Llama
곧 출시

AI 탐지기 신호 기반 분석

AI 감지는 곧 제공될 예정이며, 현재는 사용하실 수 없습니다. 출시 시점에 모든 AI 감지기는 — 저희도 포함하여 — 때때로 오답을 내놓습니다. Noplag은 단일 예/아니요가 아니라 보정된 가능성 점수를 반환하며, 비원어민 영어 작성자에 대한 오탐률을 공개합니다. ChatGPT, Claude, Gemini, GPT-5, Llama 범위를 지원할 예정입니다. 점수 해석 전에 실제 의미를 반드시 읽어보십시오 — 특히 학생이나 구직자 심사에 쓸 경우. 감지는 여러 신호 중 하나일 뿐입니다. 단일 근거로 삼아서는 안 됩니다.

0 / 1,500 words
보정 데이터 공개ESL 편향 방지5개 모델 계열
모델별 감지

주요 LLM별 감지 신호 지원.

각 모델은 고유한 통계 신호를 남깁니다. 릴리스별로 추적하며, 모델별 보정 데이터를 공개합니다. 점수가 해당 LLM에서 어떤 의미인지 알 수 있습니다.

OpenAI

ChatGPT

gpt-4o, o1, o3 시리즈 지원. 릴리스마다 출력 차이를 추적하고, 모델별 보정은 30일내 재학습합니다. 보고서에는 감지 신호와 가장 일치하는 모델 계열이 명시됩니다.

Anthropic

Claude

Sonnet, Opus, Haiku (3.x 및 4.x). 감지 신호는 모드(논리/속도)에 따라 다르며, 보고서에서 각 모드별 보정 정보가 표시됩니다.

Google

Gemini

1.5 Pro, 2.0 Flash, 2.5 Pro. 영어 외 언어에서는 감지 신호가 약합니다. 보고서에서는 이를 숨기지 않고 '리소스 부족 신뢰도'로 표시합니다.

OpenAI

GPT-5

OpenAI 2025년 8월 릴리스. gpt-4o와 다른 행동 신호를 갖습니다. 릴리스 30일 내에 모델 카드 참조 출력을 기반으로 재학습합니다.

Meta (open-weight)

Llama

3, 3.1, 3.3 시리즈. 자체 호스팅 파생 모델은 감지가 더 어렵습니다 — 파인튜닝 시 신호가 달라집니다. 보고서에는 'Llama 계열 LLM 생성 추정'만 표기하며, 특정 버전은 명시하지 않습니다.

ESL 작성자 편향

모든 AI 감지기는 비원어민 영어 작성자를 과잉탐지합니다. 저희는 이렇게 개선합니다.

Liang et al. (Stanford, 2023)는 TOEFL 에세이에서 오탐률 61%를 측정했습니다 — 원어민의 6배. 모든 감지기가 그랬습니다. 개선 전 저희도 마찬가지였습니다.

Stanford 논문

Liang et al. (2023)은 모든 상용 AI 감지기를 대상으로 비원어민 영어 TOEFL 에세이를 평가했습니다. 벤치마크 감지기는 61%를 AI 생성으로 잘못 표시 — 원어민 대비 6배. 동일한 텍스트, 동일한 과업.

저희의 재학습 내용

ESL 스타일 지표(균일한 문장 길이, 단순 어휘, 적은 관용구)를 제거해서 분류기를 재학습했습니다. 스타일-블라인드 특징만 사용. 표현력보다 구조만으로 예측.

잔여 오차율

수정 후: 단일 대표 수치 대신, 언어별 신뢰 구간을 문서화하여 제공합니다. 언어별 표는 기능이 평가를 통과하면 공개됩니다. 기관 감사에서 요구하는 수준과 동일합니다.

판단 유보 시점

ESL 작성자 평가시 점수가 20–80%면 참고용으로만 판단하십시오. 보고서에는 '신뢰도 낮음 — 주의해서 해석'이 명확히 표시되어 실제 사용자가 오용하지 않게 합니다.

여전히 놓치는 사례

하이브리드 글쓰기 — LLM 초안 후 원어민이 다듬은 글 — 단일 작성보다 판별이 어렵습니다. 보고서에는 '혼합 신호, 하이브리드 추정'을 표시하며, 일부 잔여 오차는 여기서 발생합니다.

측정 데이터 출처

공개 TOEFL 에세이 세트, 범히스패닉 학술 제출물, CEFR 등급의 다국어 글쓰기 데이터. Liang 외 연구진이 사용한 데이터와 2024-2026년에 수집된 8개의 신규 말뭉치가 포함됩니다. 참고 문헌은 기능 출시 시 방법론과 함께 공개됩니다.

점수 해석

판결이 아니라 확률입니다.

점수는 0~100%의 가능성입니다. 80% 초과: AI 생성 가능성 높음. 20% 미만: 인간 작성 가능성 높음. 20–80%는 여러 신호 중 하나로만 참고하십시오. 감지를 논의의 시작점으로만 사용하고, 끝으로 삼지 마십시오.

0–20%
인간 작성 추정

해당 텍스트가 인간에 의해 작성되었을 가능성이 높음. 이 구간의 오탐률은 기능이 평가를 통과하면 언어별로 공개됩니다.

20–80%
모호 — 추가 조사 필요

모델이 확신하지 못합니다. 점수를 여러 정보와 함께 참고하십시오 — 최근 글, 초안, 수업 내실적 등. 이 구간만으로 판단하지 마십시오.

80–100%
LLM 생성 추정

일관되게 LLM 생성일 확률이 높습니다. 판결은 아닙니다. 맥락(프롬프트, 브라우저 활동, 구술 변론 등)과 함께 해석해야 합니다.

모든 구간은 기능이 평가를 통과하면 언어별로 오차 범위를 공개합니다.
  • 5출시 시점에 대응하는 LLM 계열
  • 61%Stanford '23 기준 ESL 오탐률
  • 30d각 모델 릴리스 후 계획된 재학습 주기
  • v1.2AI content detection 출시 목표
  • 2024감지 R&D 시작
HUMANIZER 미제공 이유

저희는 부정행위 방지 편에 섭니다. 감지 우회용 도구는 제공하지 않습니다.

HUMANIZER란 AI 감지를 우회하는 도구로, LLM 출력을 새로 작성하여 감지 점수를 낮춥니다. 만들 수는 있으나, 제공하지 않습니다. 이 제품의 목적은 AI 사용을 드러내는 것이지, 감추는 것이 아닙니다. 감지가 의미 있으려면 감지자와 우회자 제작자가 동일 업체일 수 없습니다. 저희는 감지 편을 선택했습니다. 이 제품에서 humanizer를 언급할 때, 판매 목적이 아니라 upstream 텍스트에 사용될 수 있음을 알려드리기 위함입니다.

전체 입장문 읽기
VS 독립형 AI 감지기

GPTZero, Originality.ai, Winston과의 비교.

GPTZERO

교육 특화, 표절 검사 미제공, 불투명한 보정. AI 감지만 지원; 표절까지 한 번에 보고 싶다면 별도 도구 필요.

표절 탐지 및 오픈 소스 엔진 기반. 모델별 보정 데이터 공개. 동일한 보고서, 동일한 벤더, 전체 과정 검증 가능.

ORIGINALITY.AI

'97% 정확도' 마케팅. 오탐률 미공개. 영어만 보정. 닫힌 소스 — 점수의 산출 근거 자체를 확인할 수 없습니다.

ESL 편향에 대해 투명하게 공개(논문 Liang 2023을 명시적으로 인용). 다국어 보정. 오픈 소스 엔진이며, 방법론은 기능과 함께 공개됩니다.

WINSTON

ChatGPT 감지는 강점. Claude, Gemini 감지 신호는 약함. 대량사용시 가격 비쌈; 1만 단어 이상은 티어 제한.

주요 모델별 동등 보정 지원. Pro 티어까지 정액제. 컴플라이언스 요구 기관은 자체 호스팅 가능.

자주 묻는 질문

12가지 질문, 솔직한 답변.

정답을 모르면 모른다고 밝힙니다. 보정 데이터가 바뀌면 목록 업데이트합니다.

AI 감지가 정확한가요?
정직하게 답변: 약 200단어 미만의 텍스트에서는 어떤 AI detector도 신뢰할 수 없습니다. 모든 detector는 글쓰기 스타일, 언어, 사용된 LLM에 따라 오탐률이 다릅니다. Noplag은 사용 사례별로 '정확하다'는 의미가 무엇인지 알 수 있도록 보정 데이터를 공개합니다. 해당 데이터는 기능과 함께 제공됩니다.
Noplag이 제 비원어민 영어 글을 AI로 오탐지할 수도 있나요?
그럴 수 있습니다 — 이 부분은 명확히 밝힙니다. Liang et al. (Stanford 2023) 연구에서 모든 상업용 AI 감지기가 ESL 작성자를 과잉탐지했습니다. 저희는 알려진 ESL 패턴에 대해 오탐률 상한을 두고, 잔여 오차율도 공개합니다. 신호 해석이 불확실하면 보고서에 명시됩니다.
Noplag이 감지하는 AI 모델은?
출시 시점에 ChatGPT(gpt-4o, o1, o3), Claude(Sonnet / Opus / Haiku, 3.x 및 4.x), Gemini(1.5 / 2.0 / 2.5), GPT-5, Llama 3.x를 지원합니다. 감지는 곧 제공될 예정이며, 모델별 감지 품질은 다르며 보고서에 주 신호가 어떤 모델에 기반하는지 표시됩니다.
GPTZero, Originality.ai와의 차이점은?
AI 탐지와 표절 검사를 함께 제공하며, 엔진은 오픈 소스로 배포합니다. GPTZero는 탐지 기능만 제공. Originality.ai는 소스 비공개 및 ESL 편향 데이터 미공개. 세부 비교는 /vs-gptzero 및 /vs-originality-ai 참고.
학생이 humanizer로 감지를 우회할 수 있나요?
네 — humanizer는 실제로 존재하며, 이 점은 솔직히 알려드립니다. LLM 생성 후 적극적으로 리라이팅을 하면 감지 신호가 약해집니다. 저희는 humanizer를 제공하지 않습니다(저희의 목표와 상반). AI 감지는 여러 신호 중 하나로만 참고하십시오.
여기서 '오탐'이란 무슨 뜻인가요?
인간이 작성한 텍스트가 AI 생성으로 판정되는 경우. 언어 및 글쓰기 스타일별로 오탐률을 측정해 공개할 예정입니다. 어떤 detector에서도 오탐률이 0이 되는 경우는 없습니다. 높은 점수를 증거로 간주하는 것은 오용이며, 이 페이지는 그러한 오용을 방지하기 위해 제작되었습니다.
'99% 정확도' 감지 보장도 판매하나요?
아니요. 글쓰기 스타일, 언어, LLM 전반에서 약 85% 이상의 지속적인 정확도를 주장하는 것은 수학적으로 불가능합니다. 실제 신뢰 구간은 기능이 평가를 통과하면 언어별로 공개합니다. 확실성을 판매하지 않습니다.
AI 감지는 무료인가요?
AI 감지는 곧 제공될 예정입니다. 출시 후에는 무료 요금제에서 무료(표절과 동일 2,500단어 제한)로 사용하실 수 있습니다. 유료 요금제는 상한이 높아지지만, AI 감지가 별도 부가요금으로 잠기지는 않습니다.
모델 지원 커버리지는 얼마나 최신인가요?
신규 LLM 릴리스 후 30일 이내에 감지기를 재훈련합니다. 보정집합에 없는 모델의 경우 'LLM 생성 추정, 모델 미상'으로 보고서에 별도 표시합니다.
다국어 AI 감지도 하나요?
영어, 스페인어, 프랑스어, 독일어, 포르투갈어는 검증된 보정 데이터를 갖추고 있습니다 — 영어가 가장 신호가 강합니다. 기타 언어는 '리소스 부족 — 주의 필요'로 표시합니다. 제출한 텍스트에 어떤 보정 계층이 적용되는지 보고서에 명시됩니다.
API로 AI 감지 통합이 가능한가요?
곧 지원합니다. 출시 시 /v1/checks 엔드포인트에서 표절 점수와 AI 감지 점수를 모두 반환합니다. 자세한 사항은 /plagiarism-checker-api, /docs/api 참고.
점수에 동의하지 않을 때 어떻게 하나요?
알려주십시오. 교정 요청을 기록, 모델 릴리스마다 30일내 재훈련하며, 릴리스 간 행동 변화를 공개합니다. 감지가 완벽하다고 주장하지 않습니다. 잘못 판단된 경우 오히려 알려주십시오.

AI 감지 — 곧 출시, 2,500단어까지 무료.

보정 데이터, 오탐률, 모델별 신호 모두 공개됩니다. 실제 근거를 확인한 후 판단하십시오.

출시 알림 받기
AI 탐지기 주요 모델 분석