TECH 으로 돌아가기
TECH HACKER NEWS 오늘 7분 읽기 25 READS

중국이 앞서가는 오픈 모델 판도, 미국은 어디에 서 있나

중국이 앞서가는 오픈 모델 판도, 미국은 어디에 서 있나
SOURCE IMAGE · HACKER NEWS

오픈 언어 모델은 모델 가중치(weights)가 공개되어 누구나 검사하거나 활용할 수 있는 형태의 AI를 말한다. GPT-4나 Claude Opus 4.5처럼 API나 제품을 통해서만 접근할 수 있는 '폐쇄형' 모델과 대비된다. 오픈 모델은 다시 두 갈래로 나뉜다. 가중치와 라이선스, 추론 코드를 함께 공개하는 '오픈 웨이트' 모델과, 여기에 학습 코드와 학습 데이터까지 재현에 필요한 모든 정보를 공개하는 '오픈 소스' 모델이다. 메타의 Llama, 알리바바의 Qwen, 구글의 Gemma, 딥시크 모델이 전자에 속하고, 앨런AI연구소의 Olmo, OpenAthena의 Marin, EleutherAI의 Pythia 등 미국 비영리 기관이 주도하는 프로젝트가 후자에 속한다. 실제로는 엔비디아 Nemotron처럼 데이터 상당량을 공개하지만 전부는 아닌 중간 지대의 모델도 많아, 개방성은 이분법이 아니라 스펙트럼으로 이해하는 편이 정확하다.

이 글의 배경이 되는 것은 미국 의회 의원과 보좌진을 상대로 준비된 브리핑이다. 미-중 경쟁이라는 렌즈에서 오픈 웨이트 모델의 현주소를 정리한 내용으로, 결론은 분명하다. 오픈 웨이트 영역에서 중국 기업들이 이미 확실한 선두라는 것이다.

지표가 말하는 역전

한때 미국은 메타의 Llama를 앞세워 오픈 모델의 초기 주도권을 쥐고 있었다. 그러나 약 18개월 전을 기점으로 중국 오픈 웨이트 모델이 연구와 상업적 활용 양쪽에서 미국을 앞질렀다. 가장 단순한 지표는 허깅페이스 다운로드 수인데, 2025년 7월 알리바바 Qwen의 성공을 바탕으로 중국이 선두에 올라섰다. 필자가 2025년 8월 ATOM(American Truly Open Models) 프로젝트를 처음 공개한 이후로 중국의 다운로드 우위는 약 16억 건까지 벌어졌고, 누적 32억 건으로 미국 총합의 두 배에 이른다.

성능 벤치마크에서도 격차는 뚜렷하다. Artificial Analysis Intelligence Index 기준 2026년 9월 14일 시점의 상위권은 Z.ai의 GLM-5.3(45점), 문샷AI의 Kimi K3(44점), GLM-5.3-Flash(42점)로 모두 중국 모델이다. 반면 미국 선두는 Thinking Machines의 Inkling과 Inkling Small(각 26점), 엔비디아 Nemotron 3 Ultra(23점)에 그친다. 미국 상위 모델은 2026년 6~7월에 나온 뒤 갱신 주기가 길고, 중국 연구소들은 같은 점수대에 2~6개월 먼저 도달했다. 종합하면 중국 오픈 웨이트 모델은 미국 폐쇄형 프런티어에 2~5개월 뒤진 반면, 미국 오픈 웨이트 모델은 6~9개월 뒤처져 있다.

왜 중국이 빠른가, 그리고 증류의 한계

자원이 더 적은데도 중국 연구소가 강한 모델을 내놓는 이유는 여전히 논쟁적이다. 업무 문화 차이가 크게 작용하지만, 기술적으로는 더 빠른 출시 주기와 다소 좁은 과제 분포가 지목된다. 모든 연구소가 꾸준히 발전하는 상황에서 완성 시점이 늦을수록 벤치마크 점수가 유리하게 나오기 때문이다. 흔히 거론되는 '증류(distillation)' 요인도 만능은 아니다. 필자는 앤트로픽·오픈AI가 KYC 도구 등으로 증류를 완전히 차단하더라도 미국 최강 모델과 중국 오픈 웨이트 모델의 격차는 1~2개월 정도만 벌어질 것으로 추정한다. 오히려 주목할 변화는 중국 연구소들이 2026년 들어 학습 데이터, 특히 에이전트 과제용 강화학습 환경을 미국·중국 기업에서 직접 구매하기 시작했다는 점이다.

규제 딜레마와 실무적 파장

오픈 웨이트 모델의 구조적 난제는 공개된 소프트웨어가 악의적 행위자에게 도달하는 것을 막을 효과적 수단이 사실상 없다는 데 있다. 위험을 이유로 강력한 중국 오픈 모델의 접근을 제한하면, 정작 손해를 보는 쪽은 미국 기업이다. 실제로 허깅페이스는 폐쇄형 모델이 응답을 거부하자 중국 오픈 모델을 활용해 사이버 공격을 분석했다. 결국 위험 관리는 접근 차단보다 생태계 대비 역량에 달려 있다는 것이 필자의 판단이다.

한국 실무자에게 더 직접적인 신호는 채택 현황이다. OpenRouter에서 처리되는 오픈 모델 토큰은 2025년 9월 주당 약 1조 개에서 현재 주당 약 80조 개로 폭증했고, 같은 기간 중국 모델 점유율은 약 70%에서 80% 이상으로 올라섰다. 오픈 코딩 에이전트 OpenCode에서는 중국 모델 비중이 95% 이상이다. 법률 에이전트 Harvey, 코딩 에이전트 Cursor, 도어대시의 Kimi 활용, 에어비앤비의 Qwen, 퍼플렉시티의 딥시크 사용처럼 미국 유수 기업과 스타트업이 저비용·유연성을 이유로 중국 모델 위에 제품을 쌓고 있으며, 이들과 라이선스 계약을 맺는 국경 간 협력도 새롭게 나타나고 있다.

학계도 마찬가지다. arXiv 주요 ML 카테고리 논문에서 오픈 모델 언급 비율은 2023년 1월 2%에서 2026년 9월 50%로 늘었는데, 그 주도권이 Llama에서 Qwen으로 넘어갔다. Llama가 여전히 약 21% 논문에 언급되며 놀라운 생명력을 보이지만, Qwen은 30%까지 올라섰고 중국 모델 전체로는 40%를 넘겨 미국의 30%를 앞선다. 다만 희망의 신호도 있다. 비슷한 성능·크기 구간이라면 미국 모델이 불균형적으로 높은 채택률을 얻는다는 점이다. 오픈AI의 gpt-oss는 역대 가장 많이 채택된 오픈 웨이트 모델 중 하나가 됐고, 구글 Gemma 4는 Qwen 소형 모델에 견줄 만한 채택 수치를 보였다. 결국 판을 되돌리려면 미국 내 오픈 모델 투자를 지속하는 길밖에 없으며, 이는 한국 기업이 어떤 모델 위에 자사 제품과 연구를 올릴지 결정할 때도 함께 고려해야 할 지형이다.

SOURCE · HACKER NEWS
원문 전체 보기 → https://www.interconnects.ai/p/the-current-balance-of-power-...
SHARE
NEXT · CHOOSE

변화를 읽었다면,
내가 만들 수익 구조를 고릅니다.

정보를 더 모으는 데서 멈추지 않고, 광고·외주·판매·중개·구독 중 내 상황에 맞는 출발점을 정해보세요.

21가지 수익 구조 살펴보기
처리 중...