AGI Soon As Possible
Article

GLM-5.2, 오픈웨이트가 폐쇄 최강을 FrontierSWE 0.7점 차로 추격했다: MIT 라이선스 코딩 모델

2026-07-02 · 3분 읽기

코딩 AI에서 오픈웨이트 모델이 최상위 폐쇄 모델 코앞까지 따라붙었다. 중국 智谱(Zhipu, Z.ai)가 2026년 6월 13일 공개한 GLM-5.2는 FrontierSWE에서 75.1%로 Claude Opus 4.8(74.4%)을 0.7점 차로 따라붙었고, 가중치를 MIT 라이선스로 풀었다. 출력 가격은 Opus 4.8의 약 6분의 1이다. 오픈소스 코딩 1위가 폐쇄 모델의 해자를 좁히고 있다. ASAP은 이 결과를 1차 발표 기준으로 정리한다.

무엇이 새로 공개됐나

智谱는 2026년 6월 13일 GLM-5.2를 전면 개방하고 가중치를 MIT 라이선스로 공개했다. 누구나 모델을 내려받아 자가호스팅하고 상업적으로 자유롭게 쓸 수 있다. 폐쇄 API에만 존재하던 최상위급 코딩 성능이 오픈웨이트로 내려왔다는 뜻이다. 스펙 면에서는 100만 토큰 컨텍스트와 최대 12만 8천 토큰 출력을 지원하고, 사고 강도를 조절하는 두 가지 추론 모드를 함께 제공한다. 智谱는 이를 긴 코드베이스와 다단계 작업을 한 번에 다루는 에이전틱 엔지니어링용 베이스 모델로 정의한다.

세 벤치마크로 본 순위

성능은 세 지표에서 나뉜다. FrontierSWE는 75.1%로 폐쇄 최강 Claude Opus 4.8(74.4%)에 0.7점 차, MCP Atlas는 77.8% 대 77.0%로 0.8점 차다. 백만 사용자 블라인드 평가인 Code Arena Frontend에서는 Elo 1,595로 가용 모델 중 1위(전체 2위, 1위는 현재 정지된 Fable 5)에 올랐다. 세 지표 모두에서 GLM-5.2는 오픈소스 모델 가운데 코딩 성능 1위를 기록했다.

0.7점 차를 어떻게 읽어야 하나

숫자만 보면 0.7점은 오차 범위처럼 작아 보인다. 그러나 이 격차의 무게는 가격과 라이선스가 결정한다. 폐쇄 최강과 1점 미만 차이를, 상업 이용까지 허용된 오픈웨이트가 낸다는 점이 핵심이다. 벤치마크 1위 여부보다 "실무에서 이 정도 차이를 6분의 1 가격에 감수할 수 있는가"가 실제 의사결정 질문이 된다. 대부분의 코딩 워크로드에서 0.7점은 사람이 검토와 테스트로 메울 수 있는 폭이다. 반대로 자율 에이전트가 사람 개입 없이 도는 경로에서는 이 작은 격차가 누적 실패율로 벌어질 수 있어, 용도에 따라 무게가 달라진다.

단가 계산이 바뀌는 지점

GLM-5.2 가격은 출력 100만 토큰당 약 4.40달러로, Claude Opus 4.8의 25달러보다 약 6분의 1 수준이다. 입력도 100만 토큰당 약 1.4달러로 낮다. 이 구조가 흥미로운 이유는 코딩이 출력 토큰을 많이 쓰는 작업이라는 데 있다. 긴 리팩터링, 대량 코드 생성, 반복 시도가 쌓일수록 출력 단가가 총비용을 좌우한다. 성능이 0.7점 차로 거의 같은데 출력이 6분의 1이면, "가장 비싼 모델을 기본값으로 둔다"는 관성 자체가 비용이 된다. 작업별로 모델을 고르고 검증 가능한 코딩에는 더 싼 모델을 붙이는 전략이 단가를 가른다.

국내 실무자가 따질 점

한국 팀에는 두 갈래 판단이 필요하다. 첫째, MIT 라이선스라 사내 GPU에 자가호스팅하면 데이터를 밖으로 내보내지 않고 최상위급 코딩 성능을 쓸 수 있다. 민감한 사내 코드일수록 API보다 이 경로가 안전하다. 둘째, 편의를 위해 API로 쓸 경우 중국 데이터 처리 관련 리스크를 함께 따져야 한다. 즉 GLM-5.2의 가치는 "싸다"에 그치지 않고, 규제와 보안 요건이 빡빡한 조직이 오픈웨이트로 통제권을 되찾을 수 있다는 데 있다.

아직 남은 물음표

GLM-5.2 벤치마크 수치는 아직 智谱 자체 발표이며 중립 하네스의 독립 검증을 거치지 않았다. 자체 발표 성적은 유리한 조건에서 측정됐을 가능성을 배제할 수 없어, 서드파티 리더보드의 재현 결과를 기다리는 편이 합리적이다. 0.7점 차라는 결론 자체가 이 검증에 걸려 있다. 도입을 서두르기보다 대표 태스크로 자체 A/B를 돌려 실제 워크로드에서의 격차를 직접 재는 것이 안전하다.

이 발표가 가리키는 방향

GLM-5.2는 코딩에서 폐쇄 모델의 우위가 빠르게 좁아지고 있음을 보여준다. 최상위와 1점 미만 차이를 오픈웨이트가 6분의 1 가격에, 그것도 상업 이용 자유로운 MIT 라이선스로 낸다면, 폐쇄 모델의 해자는 성능이 아니라 신뢰와 검증 인프라 쪽으로 옮겨간다. 앞으로의 경쟁축은 "누가 더 똑똑한가"에서 "누가 더 싸고 통제 가능한가"로 이동할 공산이 크다.

출처: 智谱(Z.ai) GLM-5.2 공개(2026년 6월 13일; MIT 라이선스, 1M 컨텍스트·12만 8천 출력, FrontierSWE 75.1% 대 Claude Opus 4.8 74.4%로 0.7점 차, MCP Atlas 77.8% 대 77.0%, Code Arena 가용 모델 1위, 출력 100만 토큰당 약 4.40달러 대 Opus 25달러) 발표 및 보도 기반 ASAP 정리.

ASAP — AGI Soon As Possible

AI·테크 이슈,
가장 깊게

단순 소식을 넘어, 맥락과 구조까지 파고듭니다

AGI Soon As Possible · asapai.co.kr

← 전체 글 보기