AIREITER

GLM-5.3 벤치마크·가격·접속 방법: Z.ai의 새 모델 살펴보기

마지막 업데이트: 2026-08-17 07:45:11

새 기반 모델 없이도 DeepSWE 점수를 46.2에서 66.9까지 올릴 수 있을까. Z.ai의 GLM-5.3은 753B 파라미터의 GLM-5.2 기반 모델에 포스트 트레이닝만 적용해, 최전선급 코딩 모델을 겨냥한 결과물이다. 다만 출시 사흘 뒤 시점에도 토큰 단위 API 가격은 없으며, ‘오픈 웨이트’로 소개된 모델의 가중치는 2주간의 안전성 검토를 이유로 아직 공개되지 않았다.

GLM-5.3은 새 아키텍처가 아니다

GLM-5.3은 장기 소프트웨어 엔지니어링과 에이전트 작업을 겨냥한 Z.ai의 최신 플래그십으로, 2026년 8월 14일 공개됐다. 공식 모델 문서에서 가장 눈에 띄는 점은 GLM-5.2와 기반 모델이 동일하다는 사실이다. 문제 식별부터 구현, 검증, 배포까지 이어지는 실제 엔지니어링 워크플로 전체를 학습하는 포스트 트레이닝으로 성능 향상을 이뤘다는 것이 Z.ai의 설명이다.

즉 GLM-5.3은 후속 아키텍처라기보다 GLM-5.2와 같은 기반을 공유하는 형제 모델에 가깝다. GLM-5.2는 2026년 6월 중순, 753B 파라미터 Mixture-of-Experts 모델로 출시됐다. MIT 라이선스를 채택했고, 6월 17일부터 Hugging Face에서 가중치를 제공해 왔다고 출시 당시 TechTimes가 보도했다.

사양GLM-5.3GLM-5.2
기반 모델동일한 753B MoE(Z.ai 기준)753B MoE, MIT 라이선스
컨텍스트 윈도우1M 토큰1M 토큰
최대 출력128K 토큰128K 토큰
입력 / 출력텍스트 / 텍스트텍스트 / 텍스트
도구 지원Function calling, MCP, JSON 출력, 컨텍스트 캐싱, thinking 모드동일한 목록(GLM-5.2 문서)
가중치아직 미공개 - 안전성 검토로 연기6월 17일부터 Hugging Face 제공
현재 이용 방법GLM Coding Plan만 가능, API는 "coming soon"Coding Plan + 토큰 과금 API

벤치마크 수치는 어디까지 믿을 수 있나

아래 수치는 Z.ai의 출시 문서에서 가져온 것이다. GLM-5.2를 기준선으로 한 전체 전후 비교는 다음과 같다.

벤치마크GLM-5.2GLM-5.3변화
Terminal-Bench 3.04.628.3+23.7
DeepSWE v1.146.266.9+20.7
Agents' Last Exam23.828.5+4.7
ExploitBench24.4%54.4%+30.0 pts

출시 당일 가장 많이 회자된 수치는 포스트 트레이닝만으로 DeepSWE를 20.7포인트 올렸다는 주장이다. 널리 공유된 한 Reddit 분석은 이를 두고 “오늘날 가장 큰 기반 모델 안에 얼마나 많은 역량이 여전히 숨어 있을 수 있는지”를 보여주는 사례라고 해석했다. 같은 출시 페이지는 44개 직업 범주를 다루는 GDPval-AA v2에서 1,769점을 기록했다고 밝히며, GLM-5.3의 포지션을 순수 코딩 너머로 확장한다. 프로그래밍 역량은 “Claude Fable 5와 비슷한 수준”이라고도 주장한다.

방향성은 주목할 만하지만, 수치의 정밀도까지 입증된 것은 아니다. 출시 페이지의 결과는 벤더 자체 발표이며, 하니스 세부 사항이나 신뢰구간은 공개되지 않았다. 이를 추적하는 커뮤니티 벤치마크 스레드도 독립 재현 결과가 아직 없다고 지적한다. 현재 가능한 가장 유용한 외부 대조 자료는 r/ZaiGLM의 사용자 정리 비교다. 이에 따르면 GPT-5.6 Luna Max는 DeepSWE v1.1에서 67.2점, GLM-5.3은 66.9점으로 차이는 0.3점이다. GLM-5.3이 에이전트형 코드 작업에서 최전선 언저리에서 경쟁하고 있음을 시사하지만, 경쟁 모델을 크게 앞선다는 뜻은 아니다. 현재 이 구도를 직접 비교하려면 GPT-5.6 Luna를 호출할 수 있다. GLM-5.2는 5.3 API가 나오기 전까지 이 계열에서 API로 쓸 수 있는 플래그십이다. GLM-5.3의 포스트 트레이닝 동작을 대신할 수는 없지만, 기반 모델은 같다.

오픈 웨이트 공개가 미뤄진 이유

Axios의 출시 당일 보도에 따르면, Z.ai는 안전 नियंत्रण을 강화하기 위해 GLM-5.3의 가중치 공개를 약 2주간 보류하고 있다. 배경에는 모델의 사이버보안 성능이 있다. Z.ai는 장기 작업 환경을 확장하면서 해당 성능이 “예상을 뛰어넘었다”고 설명했다.

알려진 보안 취약점을 찾아내는 벤치마크 CyberGym에서 GLM-5.3은 84.5%를 기록했다. Z.ai 비교표 기준으로 Mythos 5의 83.8%, GPT-5.6 Sol의 83.6%보다 높은 수치다. 실제 익스플로잇 개발 과정에서의 추론을 시험하는 ExploitBench에서는 GLM-5.3이 54.4%를 기록해 GLM-5.2의 24.4%를 두 배 이상 웃돌았다. 다만 Axios의 결과 해석에서는 Claude Fable 5와 GPT-5.6 Sol에 뒤처졌다. Z.ai 문서도 한계를 분명히 한다. 우위는 익스플로잇 체인의 앞단에 집중돼 있으며, 더 깊은 익스플로잇과 완전한 공격·방어 워크플로는 “개선이 필요하다.”

공개 연기의 맥락을 보여주는 보조 사실은 두 가지다.

  • Axios에 따르면 Z.ai는 같은 날 공개 사이트를 열어, GLM 모델이 Linux 커널과 VMware 프로젝트, Apache 프로젝트 등을 포함한 대상에서 2,400개가 넘는 보안 결함을 발견했다고 밝혔다. 이 중 1,000개 이상은 심각도 critical 또는 high였다. 오픈소스 유지보수자는 GLM 기반 버그 스캔을 위해 리포지터리를 제출할 수 있다.
  • Axios 보도에 따르면 Z.ai는 가중치를 공개하는 대신, 검토 기간 동안 일부 보안 파트너에게 통제된 접근 권한을 제공하는 단계형 프로그램을 운영하고 있다. 이는 Coding Plan과는 별도 경로다.

가중치가 공개되면 Z.ai는 이후의 수정과 활용을 통제할 수 없게 된다. 회사의 발표 문구가 이 판단을 압축한다. “An open world cannot have only open attack surfaces.”

지금 GLM-5.3을 쓰는 방법

현재 일반 사용자가 GLM-5.3에 접근하는 방법은 GLM Coding Plan 구독뿐이다. 공식 문서는 API를 "coming soon"으로 표기하고 있으며, 2026년 8월 17일 기준 Z.ai 토큰 가격표에는 GLM-5.3 항목이 없다. GLM-5.2, GLM-5.1, GLM-5에는 요금이 기재돼 있으므로, 5.3은 아직 과금 API가 활성화되지 않은 상태로 보면 된다.

공식 구독 페이지의 요금제는 다음과 같다.

등급정가표시 가격제공량권장 작업 규모
Lite$18/mo$12.60/mo주 10,000 credits작은 리포지터리, 가벼운 반복 작업
Pro$80/mo$56/moLite 사용량의 6×일상 개발, 중간 규모 리포지터리
Max$168/mo$117.60/moLite 사용량의 14×중대형 리포지터리, 고사용량 에이전트

페이지에는 더 높은 기준 가격과 낮은 표시 가격이 함께 나오지만, 청구 조건은 별도로 표시되지 않는다. 월 기준 가격은 $18/$80/$168으로 보고, 더 낮은 금액은 현재 할인 가격으로 해석하는 편이 안전하다. 설정은 npx @z_ai/coding-helper 명령 하나로 끝난다. 이 명령은 선택한 도구에 플랜을 연결하며, Z.ai는 Claude Code, OpenClaw, 자체 ZCode를 포함해 20개 이상의 에이전트 도구를 지원한다고 안내한다. MCP 도구 접근은 Pro 등급부터 제공된다. Max 등급은 새 플래그십 우선 접근을 약속하고, 모든 Coding Plan 등급에는 현재 플래그십에 대한 순환 접근 권한이 포함된다.

출시 뒤에 숨어 있는 Coding Plan 가격 변화

GLM-5.3 출시에 맞춰 Coding Plan 가격도 조정됐고, 고사용량 이용자들은 곧바로 이를 체감했다. r/ZaiGLM에서 수치를 추적한 한 구독자는 구형 V2 플랜과의 비교를 올렸다. 이는 Z.ai 공식 표가 아닌 커뮤니티 데이터이므로, 실제 결제에 앞서 자신의 대시보드를 확인해야 한다.

플랜구형 가격구형 토큰/주신규 가격신규 토큰/주
Pro$65~500M$80~526M
Max$144~2B$168~1.22B

"new Max gives you ~39% fewer tokens while costing ~17% more." - u/x-primez-x, r/ZaiGLM

게시글 작성자의 계산에 따르면 Max 등급의 토큰당 비용 효율은 약 1.9배 나빠졌다. 주당 달러당 토큰은 약 13.89M에서 약 7.26M으로 내려갔다. Pro는 타격이 덜하다. 제공량은 약 5% 늘었지만 가격은 약 23% 올랐고, 같은 계산으로 달러당 토큰은 약 14% 줄었다. 같은 게시글은 모델 자체에는 높은 평가를 내리면서도 다음과 같이 경고했다.

"GLM-5.3 looks awesome… but this new coding plan probably pushes me away from Z.AI for good." - u/x-primez-x, r/ZaiGLM

API 관점에서 참고할 기준도 있다. GLM-5.3의 토큰 가격이 등장할 때까지 이 계열의 기준점은 공식 가격 페이지에 나온 GLM-5.2다. 입력 1M 토큰당 $1.40, 캐시 입력은 $0.26, 출력은 $4.40이며, 캐시 입력 저장은 현재 무료다. 같은 스레드의 한 댓글은 구독과 API의 선택에서 종량제 쪽이 낫다고 주장한다. “새 모델이 매주 또는 격주로 나오는 상황에서는 유연성이 그만한 가치가 있다.”

GLM-5.3으로 지금 옮겨야 할까

답은 현재 어떤 방식으로 모델을 쓰고 있느냐에 따라 달라진다.

현재 사용자지금 이동할까?이유
Coding Plan Pro 구독자예동일한 $80 등급에서 바로 GLM-5.3에 접근할 수 있다. DeepSWE 상승은 벤더 발표이므로, 먼저 자체 리포지터리에서 검증하는 편이 좋다.
Coding Plan Max 고사용량 이용자먼저 계산구형 Max보다 주간 토큰이 약 39% 줄었는데 가격은 더 높다. 달러당 처리량이 손익분기점 아래로 내려갔을 수 있다.
종량제 API 사용자대기아직 토큰 가격이 없다. 1M 토큰당 $1.40/$4.40인 GLM-5.2만 측정 과금이 가능한 GLM 플래그십이다.
셀프 호스팅 사용자가중치 공개 대기약 2주 검토가 끝나기 전에는 실행할 것이 없다. 동일한 753B MoE 기반이므로 멀티 GPU 서버 하드웨어가 필요하며, vLLM/SGLang 지원은 공유 기반 모델에서 예상할 수 있는 사항일 뿐 Z.ai의 확인은 아니다.
비전 기능 의존 사용자아니오GLM-5.3은 GLM-5.2와 마찬가지로 텍스트 입력·출력 전용이다. 비전은 별도의 폐쇄형 GLM-5V 라인에 남아 있다.

마지막 항목은 특히 강조할 만하다. 커뮤니티가 출시 전에 가장 크게 요구한 기능이었기 때문이다. Jie Tang이 6월 29일 GLM-5.3에 무엇이 포함돼야 하는지 물은 설문은 466,000 views를 기록했고, 비전 기능이 압도적인 응답이었다. 그러나 실제 출시된 모델에는 여전히 비주얼 인코더가 없다. 스크린샷, PDF, UI 목업을 워크플로에 넣는다면, Z.ai API에서 제공하는 GLM-5V-Turbo at $1.20/$4.00 per 1M tokens가 우회책이지 GLM-5.3이 아니다.

남은 선택지는 명확하다. 지금 구독하면 GLM-5.3을 즉시 쓸 수 있지만, 조정된 할당량도 함께 받아들여야 한다. 기다리는 쪽은 접근 권한 외에는 비용이 없다. 가중치 공개에는 Z.ai가 밝힌 검토 일정이 있지만, API는 가격과 날짜 없이 "coming soon"으로만 표시돼 있다. 현재 에이전트형 코딩 처리량이 병목이 아니라면, 2주라는 가중치 공개 대기 기간은 기다려볼 만한 길이다.

FAQ

GLM-5.3 가중치는 언제 공개되나?

Z.ai는 안전성 검토를 위해 8월 14일 출시일로부터 약 2주간 가중치 공개를 미뤘다. 일정이 유지된다면 8월 말이 예상 시점이다. GLM-5.2 가중치가 6월 출시 뒤 며칠 내 올라왔던 Hugging Face의 zai-org 조직을 확인하면 된다.

GLM-5.3은 오픈소스인가?

GLM-5.3은 오픈 웨이트 모델로 포지셔닝돼 있지만, 가중치는 아직 공개되지 않았고 출시 문서에는 라이선스도 명시돼 있지 않다. GLM-5.2가 MIT 라이선스로 출시됐기 때문에 커뮤니티는 GLM-5.3도 그럴 것으로 보고 있지만, 이는 Z.ai의 약속이 아닌 추정일 뿐이다.

GLM-5.3은 이미지나 비전을 지원하나?

아니오. 공식 문서는 1M 토큰 컨텍스트와 128K 최대 출력의 텍스트 입력·텍스트 출력만 명시한다. 네이티브 비전은 GLM-5V-Turbo, GLM-4.6V를 포함한 별도 GLM-5V 계열에 남아 있으며, Z.ai는 이를 오픈 웨이트가 아닌 API로 제공한다.

GLM-5.3의 토큰당 가격은 얼마인가?

아직 토큰당 가격은 없다. API가 "coming soon"으로 표기돼 있고, GLM-5.3은 Z.ai 가격표에 없다. 현재 이용 방법은 월 정가 $18/$80/$168의 GLM Coding Plan뿐이며, 현재 표시 가격은 $12.60/$56/$117.60이다.

GLM-5.3을 로컬에서 실행할 수 있나?

가중치가 공개되기 전까지는 불가능하다. GLM-5.2는 vLLM, SGLang, KTransformers 지원을 모델 카드에 명시해 출시됐다(TechTimes 기준). 하지만 출시 문서는 GLM-5.3의 배포 스택을 아직 언급하지 않는다. 따라서 소비자용 장비보다는 멀티 GPU 서버 하드웨어를 전제로 계획하는 편이 좋다.