ChinaModelAPI

뉴스 / 모델 동향 · 중국 프론티어

공식 출시 GLM-5.3 Zhipu / Z.ai 플래그십 LLM
2026-08-14 · 모델 동향 · 2026-08-22 업데이트 · 8월 19일 API 정식 출시(GA) — 전용 API GA 브리핑 참고

GLM-5.3 공식 출시: 사후 학습 스케일링, 창발적 사이버 보안 역량, 2주 내 가중치 공개

Z.ai가 8월 14일 GLM-5.3을 공식 발표했습니다. 기본 모델은 GLM-5.2와 동일하며, 모든 성능 향상은 사후 학습 스케일링에서 비롯되었습니다. 현재 모든 GLM Coding Plan 구독자에게 즉시 적용되었고, 사고(thinking) 매개변수에 대한 API 하위 호환성 파괴 변경(breaking change)이 포함되어 있으며, 개발진조차 놀랄 만한 속도로 실제 취약점을 탐지하고 있습니다. 또한 약 2주 후 오픈 가중치로 공개될 예정입니다. 8월 22일 업데이트: 8월 19일 API가 정식 출시(GA)되었습니다(가격은 1M 토큰당 $1.40/$4.40으로 5.2와 동일). 전체 일정, 플랫폼별 현황 및 빌더 노트는 전용 API GA 브리핑에서 확인하실 수 있습니다. 자세한 수치, 마이그레이션 주의사항, 해외 반응은 아래를 참고하세요.

핵심 결론

GLM-5.3이 공식 출시되었습니다 (2026년 8월 14일). 공식 발표에 따르면: "오늘 GLM-5.3을 출시합니다. GLM-5.2와 동일한 기본 모델을 사용하며, 모든 성능 향상은 사후 학습에서 비롯되었습니다." Z.ai는 이를 "코딩 분야에서 가장 강력한 오픈 가중치 모델"(자체 Z.ai Code Bench에서 50% 향상)이자 취약점 탐지 분야의 CyberGym 최고 수준(SOTA)이라고 평가했습니다. 배포 현황: GLM Coding Plan — 모든 구독자에게 적용 완료(포인트 기반 쿼터, 비혼잡 시간대 50% 할인); API — 마이그레이션 필수 안내 문서화(3단계 사고 강도 low/high/max 지원, thinking.type: "disabled" 삭제 — 기존 방식 요청은 실패함); 가중치 — 8월 28일경 공개 예정(안전성 강화 조치 후, 8월 19일 기준 Hugging Face 미등재). API 가격 공개 완료: 1M 토큰당 입력 $1.40 / 출력 $4.40(캐시된 입력 $0.26) — GLM-5.2와 동일하며, OpenRouter에서도 동일한 가격으로 glm-5.3이 등록되었습니다(8월 18일). 최초의 독립 벤치마크 평가 결과: Artificial Analysis 지수 60(182개 모델 중 8위). 릴레이 기반 프로덕션 환경: 5.3이 업스트림에서 안정적으로 정식 서비스(GA)될 때까지는 glm-5.2를 유지하세요.

검증된 상태 한눈에 보기

항목상태 (공식 출처 기준, 2026-08-14)
발표공식 블로그 포스트 공개: z.ai/blog/glm-5.3 ("Today we are releasing GLM-5.3")
GLM Coding Plan모든 구독자에게 배포 완료, 포인트 기반 쿼터, 비혼잡 시간대 50% 할인(혼잡 시간대 = 평일 14:00–18:00 UTC+8)
API모델 페이지 및 문서 공개 완료. glm-5.3은 사고 강도 low / high / max(기본값 max)를 지원하며, 사고 비활성화는 더 이상 지원되지 않습니다. 8월 18일부터 OpenRouter에 동일한 가격으로 등록됨
오픈 가중치"안전성 평가 및 강화 조치가 완료되는 출시 2주 후 공개 예정" — 8월 19일 기준 Hugging Face(zai-org)에 아직 미등재, 8월 28일경 공개 예상
컨텍스트 / 출력1M 컨텍스트 · 최대 128K 출력 · 텍스트 입력 / 텍스트 출력 (네이티브 비전 미지원)
API 가격1M 토큰당 입력 $1.40 / 캐시된 입력 $0.26 / 출력 $4.40(docs.z.ai 글로벌 USD 기준, 8월 19일 확인) — GLM-5.2와 동일. Coding Plan: 포인트 기반, 비혼잡 시간대 50% 할인
변경 로그 항목docs.bigmodel.cn 모델 페이지 공개 완료. 작성 시점 기준 릴리스 노트/변경 로그 페이지에는 아직 반영되지 않음

이번 배포 순서는 블로그와 Coding Plan이 먼저 공개되고 변경 로그가 뒤따르는 형태로, 문서가 먼저 나오는 일반적인 방식과 정반대였습니다. "변경 로그에 올라왔는지"만 확인하고 있다면 대응이 늦어질 수 있습니다.

수치 지표 (공식 비교표 기준 벤더 발표 수치)

아래의 모든 점수는 Z.ai가 발표에서 직접 공개한 수치입니다. 주요 항목만 선별되었으며, 블로그의 전체 표에는 약 20개의 벤치마크가 포함되어 있습니다.

벤치마크GLM-5.3GLM-5.2Kimi K3Opus 4.8Fable 5 / GPT-5.6 Sol
Terminal Bench 2.188.281.088.385.088.0 / 88.8
Terminal Bench 3.028.34.617.421.133.7 / 34.6
DeepSWE v1.166.946.267.558.069.7 / 72.7
SWE-Marathon v1.142.519.448.148.833.1 / 42.5
Agents' Last Exam (CLI)28.523.827.625.723.8 / 28.6
HLE w/ Tools62.554.759.857.963.9 / 64.5
GDPval-AA v217691508168215881743 / 1730
CyberGym84.577.280.078.183.8 / 83.6
ExploitBench54.424.432.240.078.0 / 76.5
  • 비교표 분석: GLM-5.3은 코딩/에이전트 항목에서 Kimi K3 및 DeepSeek-V4-Pro-0813(DeepSWE 62.7)과 대등하거나 앞서며, Opus 4.8과 비슷하거나 근접한 수준입니다. 다만 가장 난이도가 높은 항목(Terminal Bench 3.0, DeepSWE, ExploitBench)에서는 여전히 Claude Fable 5 및 GPT-5.6 Sol에 뒤처집니다. Z.ai 스스로도 가장 큰 개선을 이룬 영역에서 폐쇄형 프론티어 모델과의 격차가 여전히 가장 크다고 인정했습니다.
  • 토큰 효율성: 자체 Z.ai Code Bench에서 5.3은 High 강도 기준으로 약 5만 개의 출력 토큰으로 31.4%를 기록하여, 12만 개 토큰으로 29.5%를 기록한 Opus 4.8을 앞질렀습니다. Fable 5는 여전히 39.5%(Max 강도)로 선두를 달리고 있습니다.
  • 벤더 측 주장(참고용): "코딩 분야에서 가장 강력한 오픈 가중치 모델", Terminal Bench 3.0 및 ALE에서 오픈소스 최고 수준(SOTA), 코딩 사용 경험 약 50% 개선 등. 이에 대한 독립적인 검증은 약 2주 뒤 가중치 공개와 함께 이루어질 예정입니다.

최초의 독립 검증: Artificial Analysis (8월 18일)

Artificial Analysis는 8월 18일 GLM-5.3을 추가하여 최초의 비벤더 평가를 진행했습니다. 해당 모델 페이지(8월 19일 확인) 내용:

  • 지능 지수(Intelligence Index) v4.1.1: 60 — 182개 모델 중 8위(중앙값 35), 가중치 공개 전까지는 독점 모델로 분류됨, 84.7 tok/s, 첫 토큰 생성 시간(TTFT) 1.88초, 1M 컨텍스트.
  • 성능 위치: max 강도 기준 HN 벤치마크 스레드에 집계된 AA 수치에 따르면, GLM-5.3은 59.5점을 기록하여 Kimi K3(59.7점)와 대등하고 GPT-5.6 Sol(60.9점), Claude Opus 5(61.5점) 등 폐쇄형 프론티어 모델 바로 아래에 위치하며, GLM-5.2의 53.0점 대비 약 7점 상승했습니다.
  • 주의할 점 — 과도한 출력(장황함): AA는 GLM-5.3을 "매우 장황함(very verbose)"으로 명시했습니다. 지수 측정 과정에서 중앙값 7,200만 개 대비 1억 7,000만 개의 토큰을 출력했으며, 작업당 출력 토큰 수는 GPT-5.6 Sol의 약 1만 6,900개에 비해 약 4만 1,000개에 달했습니다. 지능 수준보다는 토큰 효율성이 비용 관리 측면에서 주목해야 할 부분입니다.
  • LMArena 미등재 (8월 19일 직접 확인 기준).

벤치마크를 넘어 실제 환경에서 입증된 사이버 보안 역량

이번 발표에서 가장 이례적인 부분은 Z.ai가 중국 내 여러 보안 팀과 협력하여 실제 코드베이스를 대상으로 GLM-5.2/5.3을 테스트했다는 점입니다. 전문가 검토와 중복 제거를 거친 결과, 이 모델은 커널, 브라우저 엔진, 오픈소스 인프라, 웹 애플리케이션, 네트워크 프로토콜에 걸쳐 269개 프로젝트에서 1,097개의 중·고위험도 문제를 포함해 총 2,436개의 취약점(공식 심각도 차트 기준 치명적(Critical) 107개 + 높음(High) 990개)을 식별했습니다. 가장 오래된 취약점은 1981년으로 거슬러 올라가며, 발견되기까지 취약점이 방치된 평균 기간은 26.6년에 달했습니다.

  • 발견된 취약점은 공개 Z.ai 보안 공개 원장(Security Disclosure Ledger)에 등록됩니다. unite.ai의 보도에 따르면 발표 당시 CVE가 발급되어 공개된 취약점은 53개이며, 2,383개는 아직 엠바고 상태입니다(Linux 커널 use-after-free, WebKit/Safari 메모리 버그, FreeBSD 매개변수 유효성 검사 결함 등 포함).
  • 익스플로잇 심도 벤치마크에서도 일관된 패턴을 보입니다. 5.2 대비 큰 폭의 상승(2시간 기준 ExploitGym 29→105개 과제)을 기록했으나, Mythos 5와 GPT-5.6 Sol에는 여전히 크게 뒤처집니다. 이는 공격용 프론티어 기술이라기보다는 강력한 방어 및 보안 검토 역량에 가깝습니다.
  • Z.ai 측의 설명에 따르면, 사후 학습이 확장되면서 역량이 "예상보다 빠르게 발전"하여 가중치 공개 전 2주간의 안전성 강화 기간을 두게 되었다고 합니다.

API 빌더가 대비해야 할 주요 변경 사항 (Breaking Change)

  • 마이그레이션 필수: GLM-5.3은 사고 강도 low / high / max(기본값 max, 코딩에 권장)를 지원하며, thinking.type: "disabled"는 더 이상 지원되지 않습니다. 공식 문서에서는 모델 ID를 변경하기 전에 이를 enabled로 변경하고 reasoning_effort를 설정해야 하며, "그렇지 않으면 요청이 실패합니다"라고 명시하고 있습니다.
  • Coding Plan 요금 체계: 요금제가 포인트 기반으로 변경되어 입력, 캐시된 입력, 출력이 별도로 계산됩니다. 평일 14:00–18:00 UTC+8이 혼잡 시간대이며, 주말을 포함한 그 외 시간대에는 기본 포인트의 50%만 차감됩니다. ZCode는 98% 이상의 캐시 적중률과 함께 8월 31일까지 1.5배의 쿼터 부스트를 제공합니다.
  • ChinaModelAPI 등 릴레이 서비스를 통한 이용: 프로덕션 환경에서는 당분간 glm-5.2를 유지하세요. 업스트림 API가 안정적으로 정식 서비스(GA)되면 5.3 모델 ID를 추가할 예정입니다. 마이그레이션 시에는 위의 필수 사고 매개변수 변경 사항을 미리 반영해 두어야 합니다.
  • 동일한 기본 모델 및 제원: 1M 컨텍스트 / 128K 출력 / 동일한 기능 세트(thinking, streaming, function calling, context cache, structured output, MCP)를 갖추고 있으므로, 마이그레이션은 모델 ID 및 매개변수 교체와 에이전트 루프에 대한 회귀 테스트만으로 완료할 수 있습니다.
  • 여전히 텍스트 전용: 비전 기능은 Zhipu의 피드백 수렴에서 가장 많은 요청을 받은 항목이었으나, 이번 릴리스에는 포함되지 않았습니다.

해외 반응 (8월 19일 업데이트)

  • VentureBeat는 가장 심도 있는 영문 기사(8월 14일)를 게재했습니다. Z.ai Code Bench가 자체 비공개 벤치마크라는 점을 짚으며 공식 비교표를 소개했고, GLM-5.3이 이미 Cursor에서 "심각한 취약점"을 발견했다는 Z.ai 개발자 에반젤리스트의 주장을 보도했습니다(보도 시점 기준 Cursor 측은 미확인). 또한 2주간의 가중치 공개 지연 배경으로 민감 역량에 대한 '신뢰할 수 있는 접근(trusted access)' 통제를 언급한 로이터를 인용했습니다. 아울러 프로모션으로 표기된 Coding Plan 할인 등급(Lite 월 $12.60, Pro $56, Max $117.60)을 언급했으나, Hacker News 구매자들은 표준 가격으로 $18/$80을 보고하고 있습니다.
  • The Decoder"Zhipu AI, GLM-5.3 출시하며 가장 강력한 오픈 가중치 코딩 모델이라 주장"이라는 제목으로 다루며, 동일 기반 사후 학습, 에이전트 작업에서의 가장 큰 성능 향상, 2주 후 가중치 공개, Coding Plan / ZCode / Claude Code / OpenCode를 통한 사용 가능성 등을 소개했습니다.
  • Interconnects (Nathan Lambert)는 가장 실질적인 독립 분석글인 "GLM-5.3: 중국 연구소들이 프론티어와 보조를 맞추는 방법"을 게시했습니다. 그는 점수가 "진짜"라고 평하며 단순 증류(distillation) 설명에 회의적인 입장을 보였고, 더 빠른 릴리스 주기와 텍스트/코딩에 집중된 범위를 강점으로 꼽았습니다. 또한 이 모델의 매개변수가 약 7,500억 개(Kimi K3 크기의 약 3분의 1)로 알려져 있으며 Z.ai의 연간 반복 매출(ARR)이 약 10억 달러에 달한다는 보고를 인용했습니다.
  • 로이터(검색 발췌문 기준, 본문 유료): GLM-5.3이 CyberGym에서 84.5% 대 83.8%로 "사이버 방어 테스트에서 Anthropic의 Mythos 5에 근접했다"고 보도하며, 가중치 공개 지연은 민감한 사이버 보안 역량에 대한 '신뢰할 수 있는 접근(trusted access)' 통제 테스트와 관련이 있다고 밝혔습니다.
  • Hacker News: 출시 스레드가 1,167포인트 / 댓글 582개를 기록했으며, 이후 AA 벤치마크 스레드(8월 18일)와 OpenRouter 가용성 관련 게시글(8월 19일)이 이어졌습니다.
  • Reddit r/LocalLLaMA에는 공식 블로그 링크와 함께 가중치가 "2주 내"에 공개된다는 주요 내용을 담은 "GLM 5.3 Released" 스레드가 올라왔습니다.
  • Reddit r/ZaiGLM의 Lite 플랜 사용자들은 공식 발표 며칠 전부터 GLM-5.2가 "매우 다르게 응답한다"고 보고했는데, 이는 한 번에 전환하는 방식 대신 5.2 라벨 뒤에서 단계적 배포(staged rollout)가 진행되었음을 시사합니다.
  • unite.ai는 "학습 범위를 뛰어넘은 사이버 역량"이라는 주제로 출시 소식을 다루며, 2,436건의 취약점 공개 프로그램과 8월 말로 예정된 독립 검증용 가중치 공개 일정을 강조했습니다. (참고: unite.ai는 해당 기사를 AI 생성, 에디터 검토 기사로 명시함)
  • Laurie Voss (LinkedIn) — 오픈 가중치 모델 분야의 저명한 오피니언 리더 — 는 5.2를 주력 모델로 꼽으면서 "GLM 5.3 오픈 가중치 개발 진행 중"이라고 언급하며, 그의 견해로는 GLM 라인업이 다른 오픈 가중치 진영보다 약 6~9개월 앞서 있다고 평가했습니다.

출시 5일 후 커뮤니티의 전반적인 반응

  • 긍정적 평가: 보안 연구원들은 이 모델을 "심각한 레드팀 시나리오(WordPress 플러그인 제로데이, 원격 코드 실행(RCE), 커널 익스플로잇 변형 등 — HN 실제 사례)에 응하고 이를 완벽하게 실행"하는 최초의 모델이라고 평가합니다. 보안 도구 사용 시 거부 반응(refusal) 문제로 인해 Claude 구독에서 넘어오는 팀들도 나타나고 있습니다. AA 점수(60점)는 출시 첫날 테스터들의 체감과 일치했으며, 시각화된 추론 토큰 덕분에 불필요하게 길어지는 추론 과정을 조기에 중단할 수 있습니다.
  • 부정적 평가: 지나친 장황함으로 인한 토큰 소모 증가(AA의 "매우 장황함" 지적), Coding Plan 가성비 대 API 가격에 대한 논쟁("GLM은 API 가격에서만 유리함"), 2주간의 "안전성 강화" 기간 동안 사이버 보안 능력이 은밀히 하향될 것이라는 회의론, 그리고 웹 개발 워크플로에서 여전히 가장 요구가 많은 멀티모달 기능의 부재 등이 꼽힙니다.

주요 출처

FAQ

GLM-5.3이 출시되었나요?

네 — 2026년 8월 14일 Z.ai 블로그를 통해 공식 발표되었습니다. Coding Plan 사용자는 현재 바로 이용할 수 있으며, 가중치는 약 2주 뒤에 공개됩니다.

GLM-5.3의 가격은 얼마인가요?

공개된 가격: docs.z.ai 기준 1M 토큰당 입력 $1.40 / 출력 $4.40(캐시 $0.26)으로 GLM-5.2와 동일하며, OpenRouter도 같은 가격입니다. Coding Plan은 포인트 기반이며 비혼잡 시간대 50% 할인이 적용됩니다(혼잡 시간대 = 평일 14:00–18:00 UTC+8).

기존 glm-5.2 호출에 문제가 생기나요?

아닙니다 — 5.2는 정식 버전(GA) 및 오픈 가중치 상태로 유지되며 평소처럼 라우팅됩니다. 단, 5.3으로 전환할 경우 thinking.type: "disabled" 요청은 실패하므로 매개변수를 먼저 마이그레이션해야 합니다.

5.3에 비전 기능이 추가되었나요?

아닙니다 — 텍스트 입력 / 텍스트 출력 방식입니다. 비전 기능은 커뮤니티에서 가장 많이 요청한 기능이었으나 이번 릴리스에는 포함되지 않았습니다.

관련 가이드