TECH 으로 돌아가기
TECH HACKER NEWS 오늘 6분 읽기 33 READS

arXiv 논문 속 AI가 쓴 문장, 어떻게 측정하고 어디서부터 측정이 무너질까

arXiv 논문 속 AI가 쓴 문장, 어떻게 측정하고 어디서부터 측정이 무너질까

“요즘 논문, AI가 쓴 것 같은데?”를 숫자로 만들기

ChatGPT 이후로 학계에는 공공연한 비밀이 하나 있어요. 논문의 상당 부분이 LLM의 손을 거쳐서 나온다는 건데요. 느낌으로는 다들 아는데, 이걸 실제로 측정하려고 하면 이야기가 갑자기 어려워져요. 최근 arXiv(물리학, 수학, 컴퓨터과학 분야 논문을 정식 출판 전에 공개하는 사이트예요) 전체를 대상으로 AI가 쓴 글의 비율을 측정하는 시도가 공개됐는데, 흥미로운 건 결과 수치 자체보다 “이 측정이 어디서부터 무너지는가”를 솔직하게 짚었다는 점이에요.

측정은 어떻게 하냐면

개별 문서를 놓고 “이거 AI가 썼어, 사람이 썼어?”를 판별하는 AI 탐지기는 신뢰도가 낮기로 악명이 높아요. 그래서 이런 대규모 측정은 다른 접근을 써요. 개별 판별 대신 집단 수준의 통계 변화를 보는 거예요.

이게 뭐냐면, LLM은 특정 단어를 사람보다 훨씬 자주 써요. “delve”(파고들다), “intricate”(복잡한), “pivotal”(중추적인) 같은 단어들이 대표적인데요. ChatGPT 등장 전 수년치 논문에서 이런 단어들의 사용 빈도 기준선을 잡아두고, 등장 이후 빈도가 얼마나 튀었는지를 보면 “전체 텍스트 중 몇 퍼센트가 LLM을 거쳤는지”를 역산할 수 있어요. 논문 한 편 한 편에 대해서는 아무 말도 못 하지만, “이 분야 초록의 X%는 LLM 손을 거쳤다” 같은 집계 추정은 가능한 거죠. 실제로 스탠퍼드 연구팀이 이런 방식으로 컴퓨터과학 분야 초록의 상당수가 LLM으로 수정됐다고 추정한 연구를 내놓은 적도 있어요.

그런데 이 측정, 여기서 무너져요

문제는 이 방법의 전제가 시간이 지나며 깨진다는 거예요. 첫째, 사람이 변해요. LLM이 쏟아내는 문체에 모두가 노출되다 보니, AI를 전혀 안 쓰는 사람도 “delve”를 예전보다 자주 쓰게 되거든요. 인간 글쓰기의 기준선 자체가 AI 쪽으로 이동하면, 순수한 인간의 글도 AI로 잡히기 시작해요.

둘째, 모델이 변해요. 측정의 기준이 되는 “AI스러운 단어” 목록은 특정 시기 특정 모델의 버릇인데, 새 모델이 나올 때마다 문체가 달라져요. 심지어 요즘 모델들은 “AI처럼 쓰지 마”라는 지시를 잘 따라서 시그니처 단어를 피해가며 쓸 수도 있고요. 탐지 기준이 알려지는 순간 회피가 가능해지는, 보안에서 말하는 고전적인 군비 경쟁 구도인 거죠.

셋째, “AI가 썼다”의 정의가 흐릿해요. 아이디어와 실험은 전부 사람이 하고 영어 문장만 다듬은 논문과, 내용 생성까지 AI에게 맡긴 논문이 같은 수치로 잡혀요. 특히 영어가 모국어가 아닌 연구자들(우리나라 연구자들 포함이죠)이 문법 교정 용도로 LLM을 쓰는 경우가 많아서, 이 수치를 “부정행위 비율”로 읽으면 완전히 잘못된 해석이 돼요.

우리에게 주는 교훈

한국 개발자와 연구자에게 이 이야기는 두 가지로 다가와요. 하나는 방어적인 교훈이에요. 채용, 과제 평가, 논문 심사 같은 곳에서 “AI 탐지기 돌려서 걸러내자”는 유혹이 있는데, 개별 문서 판별은 원리적으로 신뢰하기 어렵다는 걸 이 측정의 한계가 잘 보여줘요. 억울한 피해자를 만들기 딱 좋은 도구인 거죠. 비원어민의 영어 글은 오탐률이 더 높다는 연구도 있어서, 한국인이 쓴 영어 글은 더 쉽게 억울하게 걸리고요.

다른 하나는 데이터 엔지니어링 관점의 교훈이에요. “직접 측정할 수 없는 것을 집단 통계의 변화로 추정한다”는 접근 자체는 배워둘 만해요. 다만 기준선이 살아 움직이는 대상을 측정할 때는, 그 측정 도구의 유효기간이 언제 끝나는지까지 함께 설계해야 한다는 것까지가 한 세트고요.

정리하면

AI가 쓴 글의 비율은 집단 수준에서는 대략 측정할 수 있지만, 그 측정은 인간과 모델이 서로에게 적응하는 순간부터 무너지기 시작해요. 여러분은 어떠세요? 논문이든 블로그든 글쓰기에 AI를 어디까지 쓰는 게 괜찮다고 생각하세요? 그리고 그 경계를 기술적으로 검증하는 게 애초에 가능한 일일까요?


🔗 출처: Hacker News

SOURCE · HACKER NEWS
원문 전체 보기 → https://unslop.run/blog/measuring-ai-writing-on-arxiv
SHARE
처리 중...