/ 뉴스 / Z.ai의 GLM-5.3, 코딩 성능 50% 향상 및 오픈 웨이트 벤치마크 1위 달성
GLM-5.3

Z.ai의 GLM-5.3, 코딩 성능 50% 향상 및 오픈 웨이트 벤치마크 1위 달성

2026년 8월 14일4 분 소요
Z.ai의 GLM-5.3, 코딩 성능 50% 향상 및 오픈 웨이트 벤치마크 1위 달성

뉴스 요약

베이징에 본사를 둔 AI 연구소 Z.ai(Zhipu AI)는 2026년 8월 14일(베이징 시간) 공식적으로 GLM-5.3을 출시하며, 이 모델을 지금까지 개발한 가장 강력한 오픈 웨이트 코딩 및 에이전트 시스템으로 positioning했습니다. 이번 릴리스는 GLM-5.2와 동일한 기본 아키텍처를 유지하며, 모든 성능 향상은 더 큰 기초 모델이 아닌 훨씬 확장된 사후 훈련 단계에서 비롯되었습니다. Z.ai는 이러한 접근 방식을 '사후 훈련 스케일링'이라 명명하고, 처음부터 재훈련하지 않고도 모델의 지능 한계를 끌어올릴 수 있다고 설명합니다.

이용 가능 여부 및 배포

GLM-5.3은 2026년 8월 14일(베이징 시간) 발표 시점을 기준으로 Z.ai의 API와 GLM Coding Plan을 통해 즉시 사용할 수 있으며, 기존 코딩 플랜 구독자에게도 이미 배포가 완료되었습니다. 오픈 모델 가중치는 아직 공개되지 않았습니다. Z.ai는 예상보다 강력한 사이버 보안 능력에 대한 추가 안전성 평가 및 강화 작업을 마친 뒤, 2026년 8월 말경(베이징 시간)인 약 2주 후에 가중치를 공개할 계획이라고 밝혔습니다. API에서 GLM-5.3은 낮음, 높음, 최대 등 세 가지 선택 가능한 추론 강도 수준을 도입했으며, 이전 릴리스와 달리 개발자가 모델의 추론 단계를 완전히 비활성화할 수 없도록 변경되었습니다. Z.ai는 이를 즉각적이고 비추론적인 응답을 기반으로 구축된 애플리케이션에게는 호환성을 깨는 변경 사항이라고 안내했습니다.

코딩 및 에이전트 벤치마크

Z.ai는 내부 Z.ai Code Bench 테스트 결과 GLM-5.3이 GLM-5.2 대비 코딩 능력이 약 50% 향상되어, 여러 공개 평가에서 오픈 웨이트 시스템 중 1위를 차지했다고 보고했습니다. 주요 벤치마크 상승 폭으로는 Terminal-Bench 3.0이 4.6에서 28.3으로, DeepSWE v1.1이 46.2에서 66.9로, Agents' Last Exam CLI가 23.8에서 28.5로 개선되었습니다. 내부 Code Bench에서는 GLM-5.3이 약 50,000 토큰의 추론을 사용하여 31.4%를 기록했는데, 이는 120,000 토큰을 사용한 Claude Opus의 29.5%를 앞선 수치이지만 동일한 벤치마크에서 최첨단 독점 시스템에는 미치지 못했습니다. Z.ai는 경쟁력 확보 차원에서 이번 릴리스를 GPT-5.6 Sol, DeepSeek-V4 Pro, Moonshot의 Kimi K3와 비교하기도 했습니다. 이러한 기술적 성과는 장문맥 처리 기능(IndexShare), 회사가 SAO라고 부르는 강화 학습 기법, 그리고 'slime' 훈련 프레임워크가 결합된 결과이며, 여기에 전문 엔지니어링 워크플로를 모델링한 더욱 다양하고 광범위한 장기 훈련 환경이 적용되었습니다.

예상보다 빠르게 성장한 사이버 보안 능력

Z.ai의 릴리스 노트에서 주목할 만한 점은 GLM-5.3의 공격적 보안 능력이 훈련의 주 목표였던 코딩 성능 향상보다 더 빠르게 확장되었다는 것입니다. CyberGym에서 모델은 GLM-5.2의 77.2%에서 상승한 84.5%를 기록했고, ExploitBench에서는 점수가 24.4%에서 54.4%로 두 배 이상 뛰었습니다. 시간 제한 익스플로잇 개발 테스트에서 GLM-5.3은 2시간 내에 105개, 6시간 내에 130개의 작업을 완료하여, 전작의 각각 29개 및 39개 실적을 크게 상회했습니다. Z.ai는 GLM-5.2 출시 이후 내부적으로 이 모델을 활용해 269개의 오픈소스 프로젝트에서 2,436개의 취약점을 발견했으며, 그중 1,097개가 치명적이거나 높은 심각도로 분류되었다고 밝혔습니다. 출시 시점에 53건의 발견 사항에 공개 CVE 식별자가 부여되었으며, 나머지 2,383건은 관리자에게 통보되는 동안 책임 있는 공개를 위한 엠바고 상태에 있습니다. Z.ai는 모델 가중치 공개 지연이 바로 이 발견과 직접적으로 연관되어 있다고 설명하며, Z.ai의 감시 하에 있는 API 외부에서 모델의 공격적 능력을 복제하는 데 사용될 수 있는 기본 가중치를 공개하기 전에 추가적인 안전 강화가 필요하다고 강조했습니다.

업계 동향

이번 출시는 지난 몇 달간 Zhipu와 경쟁사들의 빠른 반복 개발이 이어진 가운데, 코딩 및 에이전트 작업 분야에서 선도적인 서구권 연구소와의 격차를 좁히려는 중국 AI 개발사 간의 경쟁이 심화되는 상황에서 이루어졌습니다. Sina Technology와 Eastmoney 같은 매체의 보도를 포함한 국내 언론은 GLM-5.3을 오픈소스 코딩 모델의 중요한 진전으로 평가하며, Anthropic과 OpenAI의 최신 최첨단 릴리스에는 여전히 뒤처지지만 코딩 및 에이전트 성능이 최고 수준의 독점 시스템에 근접했다고 언급했습니다. 출시 전 커뮤니티 토론에서도 네이티브 멀티모달 및 비전 지원 요청이 주를 이루었으나, GLM-5.3은 이번 릴리스에서 해당 기능을 도입하지 않았습니다.

GLM-5.3Z.ai