ChatGPT 감지 사이트란 무엇이고, 어떻게 작동할까요
ChatGPT 감지 사이트는 텍스트를 붙여넣으면 "이게 AI가 쓴 글인지 사람이 쓴 글인지"를 판별해주는 도구입니다. 작동 원리는 생각보다 단순한 편이에요.
AI가 글을 생성할 때는 통계적으로 가장 자연스러운 단어를 순서대로 고릅니다. 그 결과 문장이 지나치게 균일하고 예측 가능해지죠. 감지 도구들은 이 두 가지 패턴을 분석합니다.
- Perplexity(당혹도): 단어 선택이 얼마나 예측 가능한가. AI 글일수록 낮습니다.
- Burstiness(돌발성): 문장 길이의 변화폭. 사람은 짧고 긴 문장을 섞지만 AI는 균일한 편이에요.
이 두 지표를 조합해서 AI 작성 확률을 퍼센트로 보여주는 방식이 기본입니다. 사이트마다 추가 알고리즘이 다르기 때문에 같은 텍스트를 넣어도 결과가 달라질 수 있어요.
주요 무료 ChatGPT 감지 사이트 3곳 소개
GPTZero (gptzero.me)
2022년 에드워드 티안이 교육 목적으로 개발한 도구입니다. 무료 플랜으로 일정량의 텍스트를 매달 분석할 수 있습니다. 문장별로 어느 부분이 AI스럽게 감지됐는지 하이라이트해서 보여주는 기능이 특징이에요. 단순 퍼센트만 나오는 다른 도구들과 달리 어느 문장이 문제인지 바로 파악할 수 있어서 처음 쓸 때 꽤 유용하다는 느낌을 받았습니다.
회원가입이 필요하지만 무료 플랜만으로도 기본적인 감지는 충분히 할 수 있습니다.
Copyleaks (copyleaks.com)
2015년 표절 검사 도구로 시작해서 AI 감지 기능을 추가한 서비스입니다. 한 번에 최대 25,000자까지 스캔할 수 있고, 학교나 기업 단위에서 많이 씁니다. 무료 플랜이 제한적이라 본격적으로 쓰려면 유료 플랜이 필요합니다. 자체 공개 수치로는 높은 정확도를 주장하지만, 실제 독립 테스트에서는 수치가 상당히 갈리는 편이에요.
ZeroGPT (zerogpt.com)
회원가입 없이 바로 쓸 수 있어서 접근성이 가장 높은 도구입니다. 한 번에 15,000자까지 분석할 수 있고, 결과는 AI 포함 비율을 퍼센트로 단순하게 보여줍니다. gpt detector 무료 도구를 찾는다면 가장 먼저 떠올릴 만한 선택지예요.
같은 텍스트로 직접 테스트한 결과
실제로 두 가지 텍스트를 세 사이트에 넣어봤습니다.
- 텍스트 A: ChatGPT로 생성한 영어 에세이 (편집 없음)
- 텍스트 B: 직접 작성한 한국어 블로그 글
결과를 보면 도구마다 편차가 상당했습니다.
텍스트 A(AI 생성)에서는 GPTZero가 가장 강하게 반응했고, ZeroGPT는 상대적으로 낮은 AI 비율을 출력했습니다. GPTZero가 공개한 내부 벤치마크에 따르면 3,000개 샘플 테스트에서 GPTZero의 전체 정확도는 99.3%, Copyleaks는 90.7%로 나타났습니다. 다만 이 수치는 GPTZero 자체 비교 자료이기 때문에 참고 정도로 보는 편이 적절합니다.
텍스트 B(사람이 쓴 한국어 글)에서 가장 당혹스러웠던 건 ZeroGPT의 반응이었습니다. 분명히 직접 쓴 글인데 AI 포함 가능성이 꽤 높게 나왔어요. 이게 오탐(False Positive)입니다.
같은 텍스트를 넣어도 사이트마다 결과가 다르게 나오는 경험을 직접 해보면, "이걸 믿어도 되나?" 싶은 생각이 자연스럽게 들 수밖에 없습니다.
감지 결과가 틀리는 경우 — 한계와 오탐
ChatGPT 감지기 정확도를 이야기할 때 오탐 문제를 빼놓을 수 없습니다.
한 독립 테스트에 따르면 ZeroGPT의 오탐률은 약 14.6%로, 7명 중 1명꼴로 사람이 쓴 글을 AI 작성으로 잘못 판정할 수 있습니다. 영어가 모국어가 아닌 필자의 경우 이 비율이 더 높아진다는 분석도 있어요.
오탐이 더 자주 발생하는 상황은 다음과 같습니다.
- 학술 논문이나 공식 보고서처럼 문체가 균일하고 딱딱한 글
- 영어가 모국어가 아닌 필자가 쓴 글 (문장 패턴이 AI와 비슷해지는 경우)
- 250단어 이하의 짧은 텍스트
- QuillBot 같은 도구로 패러프레이즈 처리한 AI 글 (반대로 AI인데 사람으로 판정)
패러프레이즈 문제는 더 심각합니다. GPTZero의 비교 분석에 따르면, Copyleaks의 경우 QuillBot으로 패러프레이즈 처리된 텍스트에서는 정확도가 60% 수준으로 떨어진다고 나와 있습니다. AI가 쓴 글을 한 번만 가공해도 감지기가 훨씬 더 헷갈려한다는 거죠.
AI 탐지 도구 비교 자료들을 살펴보면 공통적으로 확인되는 사실이 하나 있습니다. 벤더가 공개하는 자체 정확도와 독립 테스트 결과 사이의 간격이 꽤 크다는 점이에요. 최적 조건에서 측정한 수치와 실제 사용 환경은 다릅니다.
AI 감지 도구를 어떻게 활용하면 좋을까요
ChatGPT 감지 사이트를 어떻게 써야 할지 정리하자면, 결론은 하나입니다. 단독 근거로 쓰면 안 됩니다.
학생 입장에서 제출 전 자기 점검 용도로 쓰는 건 합리적입니다. "내 글이 혹시 AI처럼 보이진 않을까" 하는 불안을 해소하는 데는 분명히 쓸모가 있어요. 다만 ZeroGPT가 AI라고 했다고 해서 실제로 AI가 쓴 것은 아닐 수 있다는 점을 항상 기억해야 합니다.
직장인이 외부 콘텐츠를 검증하는 목적으로 쓴다면 GPTZero를 우선 권합니다. 문장별 분석 기능이 있어서 어느 부분이 AI스러운지 구체적으로 확인할 수 있기 때문입니다. AI 작성 글 구별하는 법을 처음 익히는 분이라면 GPTZero 무료 플랜부터 써보는 순서가 현실적입니다.
무료로 빠르게 체크하고 싶다면 ZeroGPT가 가장 접근하기 쉽습니다. 오탐 가능성이 있다는 걸 감안하고 쓰면 충분히 유용한 도구예요.
한 가지 더 알아두면 좋은 점은, GPT-5처럼 최신 AI 모델로 생성한 글은 기존 감지기들이 더 어렵게 분류한다는 것입니다. AI가 발전할수록 감지 도구도 계속 업데이트를 따라가야 하는 구조여서, 지금 정확한 도구가 6개월 뒤에도 똑같이 정확하다는 보장은 없습니다.
감지 결과는 "참고 자료" 정도로 활용하는 것이 맞습니다. 숫자 하나만 보고 판단을 내리기보다는 글의 전체적인 맥락과 맞춰서 보는 습관이 훨씬 실용적입니다.