생성형 AI 문체 위장 확산…AI 텍스트 탐지 체계 재설계

생성형 AI 문체 위장 확산…AI 텍스트 탐지 체계 재설계

생성형 AI가 인간 문체까지 위장…AI 텍스트 탐지 신뢰도 붕괴

  • 미국·유럽 연구진이 대형언어모델이 특정 작가의 문체를 정교하게 모방하도록 학습한 결과를 공개했으며, 기존 AI 텍스트 탐지기가 이 위장된 문체를 인간 작성으로 잘못 판단하는 사례가 급증하고 있다.
  • 현재 GPTZero·Originality.ai·ChatPDF AI Detector 등은 어휘 분포·문장 길이·문법 패턴을 분석해 AI 글을 탐지해왔으나, 최신 생성형 AI는 스타일메트릭스까지 모방해 평균적 문체·불규칙성까지 흉내 내면서 탐지 알고리즘의 전제가 붕괴되고 있다.
  • 실험에서는 저자가 쓴 실제 텍스트와 생성형 AI가 모방한 텍스트를 혼합해 제시했을 때 기존 탐지기는 인간 글의 90% 이상은 맞추지만 모방 텍스트의 상당수를 인간으로 오분류했으며, 미국 검찰에 제출된 ‘가짜 탄원서’ 사례처럼 문서 위조·허위 진술 악용 가능성이 현실화되고 있다.
  • 이 변화로 저작권 분쟁·학술 부정·사법 문서 위·변조에서 ‘문체 감정’과 AI 탐지에 의존하던 국제 관행이 흔들리고 있어, 한국은 국가 차원의 공공문서 진위 검증 체계를 재설계하고 DGIST 등 국내 연구진이 개발 중인 블록 단위 텍스트 검증 기술을 정책 표준으로 흡수할 필요가 있다.
  • 향후 생성형 AI가 한국어 필명 작가·공직자·언론사 별 고유 문체까지 모방할 경우 여론조작·대국민 심리전·정치권 가짜 성명 확산이 구조적으로 쉬워지므로, 정부는 교육·학술·사법·선거 분야별로 ‘AI 활용·탐지 의존 금지 구역’을 설정하고, 검증 가능한 작성 이력·버전 기록 의무화를 법제화해야 한다.

생성형 AI 문체 위장은 탐지 기술 고도화만으로 해결되지 않으므로, 한국 정부는 공공 영역에 ‘작성 이력·원본 증명’ 의무를 부과하고 문체가 아닌 메타데이터·프로세스 기반 진위 검증 체계를 서둘러 구축할 필요가 있다.

주요 용어: 생성형 AI(텍스트·이미지 등 새 콘텐츠를 만들어내는 인공지능), AI 텍스트 탐지기(AI가 쓴 글인지 통계·패턴으로 구분하는 도구), 스타일메트릭스(문장 길이·어휘·문법 패턴을 수치화한 문체 분석 기술), 퍼플렉서티(AI가 다음 단어를 예측하는 난이도를 수치화한 값), 공공문서 진위 검증(정부 문서가 실제 사람·기관에 의해 작성됐는지 절차와 메타데이터로 확인하는 체계)

출처: The Decoder