구글이 실무형 코딩과 기업 지식 노동, 사이버 방어를 겨냥한 새 프런티어 모델 '제미나이 4 아르곤(Gemini 4 Argon)'을 공개했다. 아직 일반 출시는 아니다. 구글은 '페어윈드(Fairwind) 프로그램'을 통해 신뢰할 수 있는 사이버 방어 전문가 집단에게 먼저 접근 권한을 제공하며, 미국 정부의 자발적 출시 전 모델 접근 절차에도 참여해 가드레일을 다듬은 뒤 개발자와 기업, 소비자로 점진적으로 확대할 계획이다. 이런 단계적 접근 자체가 모델의 성능 수준이 그만큼 민감하게 다뤄지고 있다는 신호로 읽힌다.
가격은 도입기 기준으로 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러이며, 캐시된 입력 토큰은 입력가에서 95% 할인된다. 출력 편중형 워크로드에서는 비용이 빠르게 불어날 수 있는 구조인 만큼, 실무 도입 시에는 출력 분량을 어떻게 통제하느냐가 총비용을 좌우할 전망이다.
출력 토큰 100만 개라는 헤드룸
가장 눈에 띄는 변화는 출력 토큰 한도를 기존 64K에서 100만 개로 대폭 확대한 점이다. 한 번의 추론 궤적 안에서 수십만 토큰을 생성할 여유가 생기면, 모델이 문제를 중간에 끊지 않고 한 번에 깊게 파고들 수 있다. 대규모 코드베이스 마이그레이션이나 복잡한 알고리즘 설계처럼 긴 호흡이 필요한 작업에서 이 여유 공간이 실질적인 차이를 만든다는 것이 구글의 설명이다. 실무자 입장에서는 긴 작업을 여러 번 나눠 호출하며 맥락을 이어 붙이던 번거로움이 줄어들 수 있다는 의미다.
벤치마크 수치도 이 방향과 맞물린다. 실세계의 장기 소프트웨어 엔지니어링 성능을 측정하는 DeepSWE v1.1에서 77.9%로 최고 기록을 세웠고, 금융·코딩·법률·세무 작업의 경제적 영향을 미국 GDP 기여도로 가중해 평가하는 Vals Index에서도 선두에 올랐다. 자피어(Zapier)의 업무 실행 평가 AutomationBench에서는 51.3%로 1위, 긴 영상 이해를 보는 LVBench에서는 91.7%를 기록했다. 다만 이들 수치는 대부분 구글이 자체 제시한 값이며, 업계 표준 검증이 완료된 지표라기보다는 자사 평가 결과라는 점은 감안해 읽을 필요가 있다.
가드레일을 푼 사이버 방어
아르곤이 기존 모델과 결을 달리하는 지점은 사이버 방어다. 구글은 이 모델을 취약점을 자율적으로 발견하고 검증하며 패치까지 수행하도록 훈련시켰고, 신뢰할 수 있는 방어자와 내부 팀에 한해서는 '사이버 가드레일 없이' 전면 역량을 쓸 수 있도록 제공한다고 밝혔다. 보안 기업 Wiz는 무료로 공공 인프라를 보호하는 'Scan for Good' 이니셔티브에 아르곤을 투입해, 전 세계 병원이 쓰는 의료 소프트웨어에서 민감한 개인정보를 노출시키던 심각한 취약점을 찾아냈다. 이전 프런티어 모델들이 놓쳤던 위험이라는 점에서 의미가 있다. 취약점 교정 능력을 보는 CWE-bench v1에서는 68%로 공동 1위를 기록했다.
가드레일을 해제한 방어 역량은 곧 공격에도 전용될 수 있는 양날의 성격을 지닌다. 구글이 접근 범위를 신뢰할 수 있는 방어자로 한정하고 미국 정부 절차를 거치는 배경에는 이런 이중 용도 위험이 깔려 있다.
안전장치는 네 갈래로
구글은 광범위한 출시에 앞서 네 영역에서 안전장치를 강화하고 있다고 설명했다. 사이버·CBRN(화학·생물·방사능·핵) 공격 등 오용을 막기 위해 유해 요청은 거부하되 정당한 이중 용도 연구는 보존하도록 설계했고, 모델 내부 활성화를 모니터링해 오용 징후를 포착하는 기법을 개선했다. 악의적 명령으로 모델 행동을 탈취하는 간접 프롬프트 인젝션에 대해서는 Gray Swan의 IPI 벤치마크에서 가장 강한 내성을 보였다고 밝혔다. 또한 모델이 사용자 의도를 넘어서는 방식으로 작업을 수행하지 않도록 사고 연쇄(chain-of-thought)와 행동을 감시해 필요 시 실행을 중단시키는 정렬 이탈 방지 장치를 배치했다.
특히 구글은 모니터링 결과를 다시 학습에 투입하지 않도록 조심하고 있다고 강조했다. 감시를 회피하도록 모델의 추론이 학습되는 것을 막기 위한 조치로, 역량이 급격히 커지는 국면에서 추론 투명성을 유지해야 정렬 위험을 진단할 수 있다는 논리다. 이는 업계 전반에 던지는 권고이기도 하다.
종합하면 아르곤은 긴 추론을 지속하는 능력과 사이버 방어 특화라는 두 축으로 차별화를 시도한 모델이다. 현재로서는 검증된 방어자와 테스터 집단이 실사용 피드백을 제공하는 단계이며, 정식 공개는 유료 API 고객과 구글 AI 울트라 구독자부터 시작된다. 한국 실무자 입장에서는 당장 접근하기 어렵지만, 100만 출력 토큰이라는 설계 방향과 가드레일을 조정한 보안 운용 방식이 향후 프런티어 모델 도입 논의에서 참고할 만한 지점이 될 것이다.