Notícias / Model Watch · Lançamento de Pesos Abertos
Pesos abertos do GLM-5.3 chegam no prazo: o topo de linha focado em escalonamento pós-treinamento já pode ser baixado
A Zhipu fechou o ciclo iniciado em 14 de ago.: os pesos do modelo topo de linha GLM-5.3 chegaram à zai-org na noite de 28 de ago. — dentro da janela prometida de ~duas semanas para revisão de segurança, três dias após o irmão Flash. A manchete do próprio model card: "Frontier Coding with Emergent Cyber Capabilities."
Os pesos do modelo topo de linha GLM-5.3 estão disponíveis: zai-org/GLM-5.3, 141 shards safetensors + variante BF16, acesso liberado (ungated), upload concluído ~23:22 Pequim em 28 de ago. (última modificação do repo, verificado via API). A licença é personalizada, com o nome "glm-5.3" — leia o arquivo LICENSE antes de realizar auto-hospedagem comercial. Mesma base do GLM-5.2 com todos os ganhos de pós-treinamento (Terminal-Bench 3.0 4.6→28.3, AA Index 60, co-#1 em pesos abertos); API já em GA desde 19 de ago. a $1.40/$4.40.
O que foi lançado (verificado via API)
- O repositório. 153 arquivos no total, 141 shards safetensors, além de um repositório separado
GLM-5.3-BF16; acesso liberado (not gated). A página do HF ainda exibe um banner de "Upcoming release" em algumas visualizações — um artefato de template de página; a API de arquivos confirma que os artefatos estão disponíveis e prontos para download. - Licença. Personalizada, license_name "glm-5.3" (campo: other) — não é Apache 2.0. O irmão Flash inclui seus próprios termos; verifique ambos os arquivos LICENSE para ver as cláusulas relevantes para você.
- Cronograma, exatamente como prometido. "Pesos em ~duas semanas" (afirmado em 14 de ago.) → Flash antecipado (26–27 de ago., por meio da revelação do Ox Alpha) → topo de linha na janela de 28 de ago. Tópico no HN "GLM-5.3 is now open-weight": 537 pontos e subindo.
- Posicionamento. A manchete oficial do card — "Frontier Coding with Emergent Cyber Capabilities" — foca na narrativa de segurança defensiva (2.436 vulnerabilidades reais encontradas, lançamento em etapas para revisão de segurança) que definiu este ciclo de lançamento.
Quais pesos do GLM-5.3 você deve baixar?
| Sua carga de trabalho | Baixar | Por quê |
|---|---|---|
| Inteligência máxima, código + segurança cibernética + agentes de longo prazo (plataforma de inferência) | GLM-5.3 (topo de linha) | O destaque em escalonamento pós-treinamento; AA 60 co-#1 aberto; inferência de classe datacenter |
| Multimodal (entrada de imagem/vídeo) por ~1/10 do custo | GLM-5.3-Flash | 320B/A18B, primeiro da série GLM-5 nativamente multimodal; quantizações locais disponíveis |
| API hospedada, sem infraestrutura | docs.z.ai GA | $1.40/$4.44 por 1M desde 19 de ago.; roteamento de relay do glm-5.3 segue health-check |
Especificações do Flash conforme seu card oficial (320B/18B ativos); classe de parâmetros do topo de linha conforme relatórios do ciclo de lançamento (~744B MoE) — confirme na configuração do repositório antes do planejamento de capacidade.
A fronteira de pesos abertos, concluída
Com o lançamento desta noite, o atual modelo topo de linha de todos os principais laboratórios chineses pode ser baixado semanas após o lançamento: Qwen3.8-Max (2.4T, além do Apache 27B e do explorador de arquitetura Flash-Next), Kimi K3 (2.8T — já pós-treinado no Harvey Tenet) e agora o GLM-5.3 + Flash. A lacuna entre modelos de ponta e modelos abertos que definiu 2025 foi, pelo menos neste trimestre, totalmente superada pelo lado chinês.
Fontes primárias
- Hugging Face — repositório oficial zai-org/GLM-5.3 (141 shards + LICENSE, upload concluído em 28/08 às 23:22 Pequim)
- Hugging Face — zai-org/GLM-5.3-Flash (modelo irmão: 320B/A18B nativamente multimodal)
- Hacker News — "GLM-5.3 is now open-weight" (537 pontos)
- Blog oficial Z.ai — Lançamento do GLM-5.3 e acesso ao relatório técnico
- Linha do tempo: Lançamento em 14 de ago. → 19 de ago. API GA → Revelação do Ox Alpha / Flash → Chegada dos pesos desta edição
Perguntas frequentes (2026)
Os pesos foram realmente lançados?
Sim — 141 shards + BF16 na zai-org, upload concluído ~23:22 Pequim em 28 de ago. (verificado via API), sem restrições de acesso (ungated). Anúncio no HN com mais de 500 pontos.
Licença?
Personalizada, com o nome "glm-5.3" (não é Apache). Leia o arquivo LICENSE antes de realizar auto-hospedagem comercial; o Flash possui seus próprios termos.
vs GLM-5.2?
Mesma base, todos os ganhos vêm do pós-treinamento: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (co-#1 em pesos abertos). Mudança incompatível: thinking.type 'disabled' removido.
vs GLM-5.3-Flash?
Topo de linha = inteligência máxima (classe ~744B, focado em texto). Flash = 320B/A18B nativamente multimodal por ~1/10 do preço, quantizações locais. Casos de uso diferentes.
Prefere usar a API?
Em GA desde 19 de ago. — $1.40/$4.40 por 1M em docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud e plataforma de supercomputação já o disponibilizam.
O que isso consolida?
O catálogo chinês de pesos abertos: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — todos os modelos topo de linha atuais disponíveis para download em poucas semanas após o lançamento.