같은 검사기, 다른 신뢰도
같은 AI 검사기를 써도 영어 글과 한국어 글의 결과 신뢰도는 다릅니다. 영어 에세이에서는 그럭저럭 안정적인 도구가 한국어 리포트에서는 사람 글을 AI로 오판하거나, 반대로 명백한 AI 글을 통과시키는 일이 더 자주 일어납니다. 이건 특정 도구의 결함이 아니라, 한국어라는 언어와 탐지 기술의 구조가 만나며 생기는 문제입니다.
이 글은 그 구조적 이유 세 가지 — 데이터, 언어 특성, 글쓰기 문화 — 를 정리하고, 한국어 글을 검사할 때 결과를 어떻게 읽어야 하는지까지 다룹니다.
이유 1 — 학습 데이터가 영어에 쏠려 있다
AI 탐지기는 ‘사람 글'과 ‘AI 글'의 대량 표본을 학습해 차이를 구별합니다. 그런데 이 표본의 절대다수가 영어입니다. 인터넷 텍스트 자체가 영어 중심인 데다, 탐지기 개발사 대부분이 영어권 시장(미국 대학 등)을 우선하기 때문입니다.
표본이 적으면 ‘한국어 사람 글의 정상 범위'에 대한 기준 자체가 얇아집니다. 영어라면 사람 글로 분류됐을 표현의 변주가, 한국어에서는 표본 부족으로 AI 쪽에 가깝게 읽힐 수 있습니다. 스탠퍼드 연구진이 확인한 ‘비원어민 영어 글 오탐' 문제와 같은 뿌리입니다 — 탐지기는 자기가 많이 본 것에서 멀어질수록 부정확해집니다.
이유 2 — 한국어는 교착어다
한국어는 어간에 조사·어미가 붙어 문법 기능을 표현하는 교착어입니다. ‘먹다'가 ‘먹었습니다·먹었는데요·먹어버렸다'처럼 무한히 변형되고, 어순도 영어보다 자유롭습니다. 단어 단위 예측 가능성(perplexity)을 재는 탐지 기법 입장에서는, 같은 의미가 수십 가지 형태로 나타나니 ‘예측 가능한 다음 단어'의 기준이 영어보다 훨씬 흐릿해집니다.
또 하나, 많은 언어모델의 토크나이저(글을 조각으로 쪼개는 장치)가 영어 기준으로 설계돼 한국어를 더 잘게, 덜 자연스러운 단위로 쪼갭니다. 조각이 어색하게 나뉘면 통계 신호도 왜곡됩니다. 요컨대 측정 도구의 ‘자' 자체가 한국어에 잘 맞지 않는 것입니다.
이 글에서 설명한 방식대로, 내 글을 직접 검사해 보세요.
무료로 검사하기 →이유 3 — 격식체 글쓰기 문화
한국어 글 중 검사 대상이 되는 것들 — 리포트, 자소서, 논문, 공문 — 은 거의 전부 ‘~합니다/~하였다' 격식체로, 정해진 틀에 맞춰 씁니다. 서론-본론-결론 구조, 정형화된 인사와 맺음, 감정을 뺀 건조한 서술. 문제는 이 특징들이 AI 글의 통계적 특징(균일함, 예측 가능성)과 정확히 겹친다는 점입니다.
영어권에도 격식 문서는 있지만, 한국어 학술·취업 글쓰기의 정형성은 유독 강한 편입니다. 그래서 ‘성실하게 규범대로 쓴 한국어 글'일수록 역설적으로 AI 점수가 높게 나오는 경향이 있습니다. 자소서에서 오탐이 잦은 이유도 같은 구조입니다.
그래서 한국어 검사 결과는 이렇게 읽으세요
첫째, 한국어에 최적화된 도구를 쓰세요. 영어 전용에 가까운 탐지기에 한국어를 넣으면 신뢰도가 크게 떨어집니다. AI 글 판별기는 한국어 글에 맞춰져 있고, 언어를 확실히 판별하지 못하면 그 사실을 표시합니다. 둘째, 점수보다 문장별 하이라이트를 보세요. 총점은 언어 요인으로 흔들려도, ‘어느 문장이 상대적으로 기계적인가'는 여전히 유용한 신호입니다.
셋째, 한국어 점수는 영어보다 한 단계 더 보수적으로 해석하세요. 애매한 중간 점수로 남의 글을 판정하는 건 한국어에서 특히 위험합니다. 본인 글 점검이라면 하이라이트 문장을 구체화하는 것으로 충분하고, 타인 글 검증이라면 점수는 대화의 출발점 이상이 될 수 없습니다.
자주 묻는 질문
한국어 전용 AI 검사기가 따로 있나요?
한국어 데이터로 학습·보정된 검사기들이 있습니다(카피킬러 GPT킬러, AI Killer 등). 영어 중심 도구보다 한국어 글에서 안정적이지만, 어떤 도구든 100% 정확하지는 않습니다.
한국어 글을 영어로 번역해서 검사하면 더 정확한가요?
권하지 않습니다. 번역 과정에서 원문의 문체 신호가 사라지고 번역기의 문체가 덧씌워져, 원문이 사람 글인지 AI 글인지와 무관한 결과가 나옵니다.
격식체로 쓰면 무조건 AI로 나오나요?
무조건은 아닙니다. 격식체라도 구체적 사례·수치·본인만의 표현이 있으면 사람 신호가 살아납니다. 문제는 격식체+일반론 조합입니다.
⚠️ AI 탐지 점수는 확률적 신호이며 100% 정확하지 않습니다. 사람이 쓴 글을 AI로 오판할 수 있습니다. 부정행위·학사 평가의 단독 근거로 점수를 쓰지 마세요.
AI Killer 편집팀
이 사이트의 AI 검사기를 직접 개발·운영하며, AI 글 판별과 학술 무결성을 주제로 씁니다. 모든 가이드는 게시 전에 도구의 실제 동작과 공개 자료를 확인해 작성하고, 탐지 도구가 바뀌면 내용을 다시 점검합니다.