ChinaModelAPI

Notícias / Model Watch · Lançamento de Pesos Abertos

Pesos abertos GLM-5.3 flagship 141 shards + BF16 licença personalizada glm-5.3
2026-08-29 · Model Watch · enviado em 28 de ago. ~23:22 Pequim, dentro do prazo prometido

Pesos abertos do GLM-5.3 chegam no prazo: o topo de linha focado em escalonamento pós-treinamento já pode ser baixado

A Zhipu fechou o ciclo iniciado em 14 de ago.: os pesos do modelo topo de linha GLM-5.3 chegaram à zai-org na noite de 28 de ago. — dentro da janela prometida de ~duas semanas para revisão de segurança, três dias após o irmão Flash. A manchete do próprio model card: "Frontier Coding with Emergent Cyber Capabilities."

Resposta direta

Os pesos do modelo topo de linha GLM-5.3 estão disponíveis: zai-org/GLM-5.3, 141 shards safetensors + variante BF16, acesso liberado (ungated), upload concluído ~23:22 Pequim em 28 de ago. (última modificação do repo, verificado via API). A licença é personalizada, com o nome "glm-5.3" — leia o arquivo LICENSE antes de realizar auto-hospedagem comercial. Mesma base do GLM-5.2 com todos os ganhos de pós-treinamento (Terminal-Bench 3.0 4.6→28.3, AA Index 60, co-#1 em pesos abertos); API já em GA desde 19 de ago. a $1.40/$4.40.

O que foi lançado (verificado via API)

  • O repositório. 153 arquivos no total, 141 shards safetensors, além de um repositório separado GLM-5.3-BF16; acesso liberado (not gated). A página do HF ainda exibe um banner de "Upcoming release" em algumas visualizações — um artefato de template de página; a API de arquivos confirma que os artefatos estão disponíveis e prontos para download.
  • Licença. Personalizada, license_name "glm-5.3" (campo: other) — não é Apache 2.0. O irmão Flash inclui seus próprios termos; verifique ambos os arquivos LICENSE para ver as cláusulas relevantes para você.
  • Cronograma, exatamente como prometido. "Pesos em ~duas semanas" (afirmado em 14 de ago.) → Flash antecipado (26–27 de ago., por meio da revelação do Ox Alpha) → topo de linha na janela de 28 de ago. Tópico no HN "GLM-5.3 is now open-weight": 537 pontos e subindo.
  • Posicionamento. A manchete oficial do card — "Frontier Coding with Emergent Cyber Capabilities" — foca na narrativa de segurança defensiva (2.436 vulnerabilidades reais encontradas, lançamento em etapas para revisão de segurança) que definiu este ciclo de lançamento.

Quais pesos do GLM-5.3 você deve baixar?

Sua carga de trabalhoBaixarPor quê
Inteligência máxima, código + segurança cibernética + agentes de longo prazo (plataforma de inferência)GLM-5.3 (topo de linha)O destaque em escalonamento pós-treinamento; AA 60 co-#1 aberto; inferência de classe datacenter
Multimodal (entrada de imagem/vídeo) por ~1/10 do custoGLM-5.3-Flash320B/A18B, primeiro da série GLM-5 nativamente multimodal; quantizações locais disponíveis
API hospedada, sem infraestruturadocs.z.ai GA$1.40/$4.44 por 1M desde 19 de ago.; roteamento de relay do glm-5.3 segue health-check

Especificações do Flash conforme seu card oficial (320B/18B ativos); classe de parâmetros do topo de linha conforme relatórios do ciclo de lançamento (~744B MoE) — confirme na configuração do repositório antes do planejamento de capacidade.

A fronteira de pesos abertos, concluída

Com o lançamento desta noite, o atual modelo topo de linha de todos os principais laboratórios chineses pode ser baixado semanas após o lançamento: Qwen3.8-Max (2.4T, além do Apache 27B e do explorador de arquitetura Flash-Next), Kimi K3 (2.8T — já pós-treinado no Harvey Tenet) e agora o GLM-5.3 + Flash. A lacuna entre modelos de ponta e modelos abertos que definiu 2025 foi, pelo menos neste trimestre, totalmente superada pelo lado chinês.

Fontes primárias

Perguntas frequentes (2026)

Os pesos foram realmente lançados?

Sim — 141 shards + BF16 na zai-org, upload concluído ~23:22 Pequim em 28 de ago. (verificado via API), sem restrições de acesso (ungated). Anúncio no HN com mais de 500 pontos.

Licença?

Personalizada, com o nome "glm-5.3" (não é Apache). Leia o arquivo LICENSE antes de realizar auto-hospedagem comercial; o Flash possui seus próprios termos.

vs GLM-5.2?

Mesma base, todos os ganhos vêm do pós-treinamento: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (co-#1 em pesos abertos). Mudança incompatível: thinking.type 'disabled' removido.

vs GLM-5.3-Flash?

Topo de linha = inteligência máxima (classe ~744B, focado em texto). Flash = 320B/A18B nativamente multimodal por ~1/10 do preço, quantizações locais. Casos de uso diferentes.

Prefere usar a API?

Em GA desde 19 de ago. — $1.40/$4.40 por 1M em docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud e plataforma de supercomputação já o disponibilizam.

O que isso consolida?

O catálogo chinês de pesos abertos: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — todos os modelos topo de linha atuais disponíveis para download em poucas semanas após o lançamento.

Guias relacionados