뉴스 / Model Watch · 오픈 가중치 출시
GLM-5.3 오픈 가중치 예정대로 공개: 사후 학습 스케일링 플래그십 모델 다운로드 개시
Zhipu가 8월 14일에 시작했던 행보를 매듭지었습니다: GLM-5.3 플래그십 가중치가 8월 28일 밤 zai-org에 공개되었습니다 — Flash 형제 모델 출시 3일 만이자, 약속된 약 2주간의 안전성 검토 기간 내입니다. 모델 카드의 자체 헤드라인: "창발적 사이버 역량을 갖춘 프론티어 코딩."
GLM-5.3 플래그십 가중치 공개: zai-org/GLM-5.3, 141개 safetensors 샤드 + BF16 변형, 게이트 제한 없음(ungated), 베이징 시간 8월 28일 약 23:22 업로드 완료 (저장소 최종 수정 시간 기준, API 검증 완료). 라이선스는 "glm-5.3"이라는 이름의 커스텀 라이선스입니다 — 상업적 셀프 호스팅 전 LICENSE 파일을 확인하세요. GLM-5.2와 동일한 베이스에 사후 학습을 통한 모든 성능 향상 적용 (Terminal-Bench 3.0 4.6→28.3, AA Index 60, 오픈 모델 공동 1위); API는 이미 8월 19일부터 $1.40/$4.40에 GA 완료.
출시 내역 (API 검증 완료)
- 저장소. 총 153개 파일, 141개 safetensors 샤드 및 별도의
GLM-5.3-BF16저장소 포함, 게이트 제한 없음(not gated). 일부 화면의 HF 페이지에는 여전히 "Upcoming release" 배너가 표시되지만 이는 페이지 템플릿의 잔재이며, 파일 API를 통해 실제 파일이 배포되어 다운로드 가능함을 확인했습니다. - 라이선스. Apache 2.0이 아닌 커스텀 라이선스(license_name "glm-5.3", 필드: other)입니다. Flash 자매 모델은 별도 약관으로 제공되므로 필요한 조항은 두 모델의 LICENSE 파일에서 직접 확인하세요.
- 약속대로 정확히 맞춘 일정. "약 2주 내 가중치 공개"(8월 14일 발표) → Flash 조기 공개(8월 26~27일, Ox Alpha 공개를 통해) → 8월 28일 일정에 맞춘 플래그십 공개. HN의 "GLM-5.3 is now open-weight" 스레드는 537점을 기록하며 계속 상승 중입니다.
- 포지셔닝. 공식 모델 카드 헤드라인인 "창발적 사이버 역량을 갖춘 프론티어 코딩(Frontier Coding with Emergent Cyber Capabilities)"은 이번 출시 주기를 대표하는 방어적 보안 스토리(실제 취약점 2,436건 발견, 안전성 검토를 위한 단계적 출시)를 전면에 내세우고 있습니다.
어떤 GLM-5.3 가중치를 다운로드해야 할까요?
| 워크로드 유형 | 다운로드 대상 | 선택 이유 |
|---|---|---|
| 최고 지능, 코딩 + 사이버 + 장기 태스크 에이전트 (추론 플랫폼) | GLM-5.3 (플래그십) | 사후 학습 스케일링의 핵심 모델; AA 60 오픈 모델 공동 1위; 데이터센터급 서빙 |
| 약 1/10 비용의 멀티모달 (이미지/비디오 입력) | GLM-5.3-Flash | 320B/A18B, 최초의 네이티브 멀티모달 GLM-5 시리즈; 로컬 양자화 버전 제공 |
| 인프라 구축이 필요 없는 호스팅형 API | docs.z.ai GA | 8월 19일부터 100만 토큰당 $1.40/$4.44; glm-5.3 릴레이 라우팅은 헬스체크 기반 동작 |
Flash 스펙은 공식 카드 기준(320B/18B 활성), 플래그십 파라미터 규모는 출시 보도 기준(~744B MoE) — 용량 산정 전 저장소 설정을 확인하세요.
완성된 오픈 가중치 프론티어
오늘 밤 공개로 중국 주요 AI 연구소의 현재 플래그십 모델이 모두 출시 수 주 만에 다운로드 가능해졌습니다: Qwen3.8-Max(2.4T, Apache 27B 및 Flash-Next 아키텍처 탐색 모델 포함), Kimi K3(2.8T — 이미 Harvey Tenet으로 사후 학습 완료), 그리고 이번 GLM-5.3 + Flash까지. 2025년을 규정했던 프론티어와 오픈 가중치 간의 격차는 적어도 이번 분기 중국 진영에서는 완전히 좁혀졌습니다.
주요 출처
- Hugging Face — zai-org/GLM-5.3 공식 저장소 (141개 샤드 + LICENSE, 베이징 시간 08-28 23:22 업로드 완료)
- Hugging Face — zai-org/GLM-5.3-Flash (자매 모델: 320B/A18B 네이티브 멀티모달)
- Hacker News — "GLM-5.3 is now open-weight" (537점)
- Z.ai 공식 블로그 — GLM-5.3 출시 및 기술 보고서 링크
- 관련 타임라인: 8월 14일 발표 → 8월 19일 API GA → Ox Alpha / Flash 공개 → 본 기사의 가중치 출시
자주 묻는 질문 (2026)
가중치가 실제로 출시되었나요?
네 — zai-org에 141개 샤드 + BF16 버전이 업로드되었으며, 베이징 시간 8월 28일 약 23:22에 업로드 완료(API 검증 완료), 게이트 제한 없음(ungated). HN 발표 글은 500점 이상을 기록 중입니다.
라이선스는 무엇인가요?
Apache가 아닌 "glm-5.3"이라는 명칭의 커스텀 라이선스입니다. 상업적 셀프 호스팅 전 LICENSE 파일을 확인하세요. Flash에는 별도 약관이 적용됩니다.
GLM-5.2와의 차이점은?
동일한 베이스 기반이며 모든 성능 향상은 사후 학습에서 비롯되었습니다: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (오픈 모델 공동 1위). 브레이킹 체인지: thinking.type 'disabled' 제거됨.
GLM-5.3-Flash와의 차이점은?
플래그십 = 최고 지능(~744B급, 텍스트 중심). Flash = 약 1/10 가격의 320B/A18B 네이티브 멀티모달, 로컬 양자화 지원. 담당하는 역할이 다릅니다.
API로 대체 사용하려면?
8월 19일부터 GA — docs.z.ai에서 100만 토큰당 $1.40/$4.40; ZCode, Coding Plan, PhanRouter, JD Cloud, 슈퍼컴퓨팅 플랫폼에서 모두 서비스 중입니다.
이번 출시는 무엇을 완성하나요?
중국 오픈 가중치 라인업: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — 현재 모든 플래그십 모델이 출시 수 주 만에 다운로드 가능해졌습니다.