AI 도구를 둘러싼 분위기가 어디로 움직이는지 가늠할 때, 많은 개발자는 X(옛 트위터), 인기 급상승 깃허브 저장소, 해커뉴스를 신호로 삼는다. 최근 그 신호 가운데 눈에 띄는 것이 있다. "나는 ADHD가 있다"는 식의 스킬 설정이나, 에이전트 지침 파일(Agents.md)에 "항상 ASD-STE100 단순화 기술 영어로만 출력하라"고 적어두는 관행이다. LLM 특유의 장황함과 어색한 말투를 싫어하는 마음은 누구나 공감하지만, 그것을 모델 자체를 '인간화'하는 방식으로 고치려는 접근은 추상화의 층위를 잘못 잡은 것이라는 지적이 나온다.
스타일 지시는 작업의 일부가 된다
핵심 문제는 이런 지시가 모델이 일을 다 끝낸 뒤에 적용되는 후처리가 아니라는 점이다. 짧은 문장을 쓰고, 전문 용어를 피하고, 사용자를 압도하지 말고, 가장 중요한 세부만 담으라고 요구하는 순간, 그것은 출력을 계속해서 더 낮은 대역폭의 형식으로 압축하라는 명령이 된다. 그리고 이 압축은 '과제를 풀어라', '도구를 올바르게 써라', '추상화를 보존하라', '무언가를 망가뜨리지 마라' 같은 핵심 지시들과 같은 목록 위에 나란히 놓인다. 모델 입장에서는 문체 규칙과 작업 규칙이 동등한 우선순위로 뒤섞이는 셈이다.
ASD-STE100 단순화 기술 영어가 좋은 예다. 원래 이 표준은 인간이 읽을 문서를 모호하지 않게 만들기 위해 설계됐고, 그래서 대단히 합리적으로 들린다. 하지만 에이전트는 인간 테크니컬 라이터가 아니며, 가공되지 않은 원(原)상태야말로 대개 가장 정보 밀도가 높은 표현이다. 규칙에 맞춰 문장을 다듬는 동안 무엇이 버려졌는지는 사용자가 알아채기 어렵다. 출력이 여전히 매끄럽게 읽히기 때문이다.
에이전트가 에이전트에게 말할 때
이 문제는 에이전트끼리 대화하기 시작하면 더 기이해진다. 서브에이전트가 버그를 조사한 뒤 그 결과를 보기 좋은 사람 친화적 요약으로 바꾸고, 부모 에이전트가 그 요약을 읽어 다시 사람 친화적 요약으로 바꿔 사용자에게 전달하는 구조를 떠올려 보자. 서브에이전트가 여섯 개의 테스트를 돌렸다면, 우리가 정작 받고 싶은 것은 "대부분 통과했고 하나 정도 살펴볼 만한 이슈가 있었다" 같은 문장이 아니다. 사람의 산문은 이런 뭉뚱그림에 지나치게 능하다.
더 중요한 것은 인간화가 실패를 숨긴다는 점이다. 에이전트는 유용하지만 지저분한 방식으로 실패한다. 상충하는 증거, 해소되지 않은 분기, 스택 트레이스, 불확실한 가정 같은 것들이다. 매끄러운 문장은 이런 신호를 부드럽게 뭉개 버린다. 그러나 실무자 입장에서는 에이전트가 환각을 일으키고 있거나 토큰 한계에 가까워졌다는 사실을 차라리 날것으로 발견하는 편이 낫다. 보기 좋게 정리된 결론에 안심하는 것보다 훨씬 안전하다.
경계에서 변환하라는 오래된 원칙
우리가 만드는 다른 시스템은 모두 정반대 방향으로 동작한다. 데이터베이스는 대시보드가 표시하는 형식으로 데이터를 저장하지 않고, 컴파일러는 중간 표현(IR)을 읽기 좋게 만들지 않으며, API는 서로 친절한 요약을 주고받지 않는다. 우리는 가능한 한 오래 최고 충실도의 표현을 유지하다가, 사람이 소비하는 경계에서 비로소 변환한다. 그런데 LLM 도구는 점점 이 순서를 거꾸로 하고 있다.
이것은 접근성이나 개인화를 반대하는 주장이 결코 아니다. 세 줄짜리 답변을 원하거나 단순화 기술 영어를 원한다면 그것은 얼마든지 좋다. 다만 그 압축은 파이프라인의 맨 끝에서 이뤄지는 편이 낫다는 것이다. 에이전트에게는 상세한 상태를 유지하게 하고, 서브에이전트끼리는 스키마·diff·정확한 오류·신뢰도·출처를 주고받게 한 뒤, 최종적으로 사람을 향해서만 이를 압축하는 구조다.
흥미로운 결론은 이 유행하는 스킬들이 사실은 올바른 미래를 가리키고 있을지 모른다는 점이다. 사용자들은 스택 아래쪽에 있어야 할 기능을 프롬프트 계층에서 임시로 때우고 있다. "나에게 ADHD가 있는 것처럼 말해줘"라는 요청은 렌더러, 즉 표현 계층의 설정으로는 완벽하게 타당하지만 작업 지시로서는 훨씬 덜 타당하다. 지속 가능한 형태는, 정밀하고 기계 지향적인 상태를 모국어로 삼는 에이전트가 따뜻하고 간결한 인간용 버전을 오직 경계에서만 생성하는 것이다. 그러니 이 바이럴 저장소들은 최종 상태가 아니라 일종의 버그 리포트로 읽는 편이 옳다. 실무자가 이 신호에서 얻을 교훈은 분명하다. 문체를 손보고 싶다면 모델의 사고 과정이 아니라 출력의 마지막 단계를 손봐야 한다는 것이다.