ChinaModelAPI

Noticias / Model Watch · Video

Pesos abiertos MiniMax H3 Hailuo ComfyUI
2026-08-08 · Model Watch

Pesos abiertos de MiniMax H3: llega el modelo de video A/V nativo para local + API

El H3 de MiniMax es un modelo de generación de video multimodal de propósito general, no el LLM de texto M3 de la compañía. El anuncio oficial de lanzamiento (2026-07-31) junto con la apertura de pesos a principios de agosto en Hugging Face / ComfyUI lo convierten en uno de los lanzamientos de video abierto más importantes del verano.

Respuesta directa

Sí: redáctalo como noticia. H3 unifica contexto de texto / imagen / video / audio y genera video con audio estéreo nativo (no «primero el video y luego el TTS»). Vía alojada: API de MiniMax / Hailuo (a menudo hasta ~15s, hasta 2K en versión alojada). Vía abierta: MiniMaxAI/MiniMax-H3 + flujos de trabajo nativos de ComfyUI. No lo titules «Kling 2.0/2.5 de código abierto»; ese no es el nombre del producto de MiniMax.

H3 frente a M3 (evita la confusión de nombres)

NombreModalidadRol
MiniMax H3 Video + audio nativo (omnimodal) Este informe. Modelo de generación; pesos abiertos + API
MiniMax M3 LLM de texto Línea de productos independiente en el menú de modelos de MiniMax; no es un SKU de video

Aspectos destacados de capacidades (oficial + ecosistema)

Principal: publicación de lanzamiento de MiniMax H3. Secundario: ficha de HF, ComfyUI, demos de creadores en X; nada de benchmarks inventados.

Audio y video estéreo nativo

Generación conjunta de imagen + sonido estéreo (diálogo / efectos SFX / ambientación musical) en una sola pasada: un gran factor diferenciador frente a modelos de video puramente silenciosos.

~4–15 s · hasta 2K (alojado)

Oficial: hasta unos 15 segundos a un máximo de 2K en vías alojadas. Las ejecuciones locales con pesos abiertos se suelen comentar a una resolución predeterminada más baja (ej. ~768p), salvo que se utilicen métodos de escalado/regeneración.

Referencias multimodales

Texto + imágenes + video + audio como contexto. Las notas de la comunidad y del modelo suelen citar referencias multiactivo (por ejemplo, varias imágenes + clips de video y audio) para una generación/edición controlada.

Pesos abiertos + ComfyUI

Pesos en Hugging Face; nodos y flujos de trabajo nativos de ComfyUI en cuestión de días. La comunidad ya lanza Turbo LoRAs y paquetes cuantizados: la clásica velocidad del código abierto.

«Kling abierto» vs. «Seedance abierto»: lo que realmente se dice en X

  • Enfoque oficial: modelo de video multimodal de pesos abiertos de MiniMax / Hailuo; no tiene licencia ni el nombre de Kling.
  • Debate de la comunidad sobre la calidad: comparativas frecuentes cara a cara con Seedance 2.0 / 2.5 («calidad similar», «Seedance abierto», debates sobre Elo en arena). Tómalo como anécdotas.
  • Comparaciones con Kling: aparecen como charlas informales de creadores, no como una afirmación de producto de MiniMax. No publiques «开源版可灵» como un hecho.
  • Narrativa de precios: MiniMax afirma una excelente relación calidad-precio frente a los modelos de video cerrados «convencionales» a 2K/768p; verifícalo en tu consola; no publicamos precios no oficiales de $/s como propios.

Mapa de acceso (a fecha de 2026-08-08)

SuperficieEstadoNotas
Blog de MiniMax / producto Hailuo Disponible Publicación oficial de H3
API alojada Disponible platform.minimax.io / documentación de generación de video en consola CN
Pesos en Hugging Face Disponible MiniMaxAI/MiniMax-H3 · Licencia comunitaria (leer cláusulas comerciales/territoriales)
ComfyUI Soporte nativo Flujos de trabajo oficiales + cuantizaciones/Turbo LoRA de la comunidad
Relay de ChinaModelAPI Comprobación de estado pendiente Sin ID de modelo inventados: únete a la lista de espera

Lista de verificación para desarrolladores

  1. Elige tu vía: API alojada (comodidad de 2K) frente a pesos locales (VRAM + licencia).
  2. Lee atentamente la Licencia comunitaria: en los repacks de la comunidad aparecen umbrales comerciales y exclusiones regionales; confía en el archivo LICENSE oficial.
  3. Calcula la VRAM con realismo: las configuraciones completas en BF16 discutidas habitualmente suelen superar una sola GPU de consumo sin cuantización/poda.
  4. Compara de forma creativa frente a Seedance 2.5 para evaluar la calidad del modelo insignia cerrado, y frente al más económico 2.0 Mini para el costo de iteración.
  5. Si más adelante necesitas enrutamiento de video chino compatible con OpenAI, permanece en la lista de espera de ChinaModelAPI: solo publicamos los ID después de que el enrutamiento funcione.

FAQ

H3 or M3?

H3 = video. M3 = LLM de texto de MiniMax. Líneas de productos diferentes.

¿Kling abierto?

No. La comunidad puede comparar la calidad; el nombre del producto es la línea MiniMax H3 / Hailuo.

¿Todo es de código totalmente abierto?

Se abrieron los pesos base; algunas partes alojadas (ej. regeneración a mayor resolución / servicios de contexto) pueden seguir siendo exclusivas de la API: consulta la ficha del modelo.

Relacionado en este sitio

HappyHorse API · Seedance API · Seedance 2.5

Fuentes primarias

Guías relacionadas