News / Modell-Radar · Video
MiniMax H3 Open Weights: Natives A/V-Videomodell startet für lokale Nutzung + API
MiniMax’ H3 ist ein universelles Modell zur multimodalen Videogenerierung – nicht das M3-Text-LLM des Unternehmens. Die offizielle Ankündigung (2026-07-31) und die Veröffentlichung der Open Weights Anfang August auf Hugging Face / ComfyUI machen dies zu einem der wichtigsten offenen Video-Releases des Sommers.
Ja – als News formulieren. H3 vereint Kontext aus Text, Bild, Video und Audio und generiert Videos mit nativem Stereo-Audio (nicht „zuerst Video, später TTS“). Gehosteter Pfad: MiniMax / Hailuo APIs (oft bis zu ~15s, bis zu 2K gehostet). Offener Pfad: MiniMaxAI/MiniMax-H3 + native ComfyUI-Workflows. Nicht als „Open-Source-Kling 2.0/2.5“ betiteln – das ist nicht der Produktname von MiniMax.
H3 vs. M3 (Verwechslungen vermeiden)
| Name | Modalität | Rolle |
|---|---|---|
| MiniMax H3 | Video + natives Audio (omnimodal) | Gegenstand dieses Berichts. Generierungsmodell; Open Weights + API |
| MiniMax M3 | Text-LLM | Separate Produktlinie im Modellangebot von MiniMax – kein Videomodell |
Funktions-Highlights (offiziell + Ökosystem)
Primär: MiniMax H3-Launch-Beitrag. Sekundär: HF-Card, ComfyUI, X-Creator-Demos – keine erfundenen Benchmarks.
Natives Stereo-Audio/Video
Gemeinsame Generierung von Bild + Stereoton (Dialoge / Soundeffekte / Musik) in einem Durchgang – ein wesentlicher Unterschied zu rein stummen Videomodellen.
~4–15s · bis zu 2K (gehostet)
Offiziell: bis zu etwa 15 Sekunden bei bis zu 2K über gehostete Pfade. Lokale Open-Weight-Ausführungen werden meist bei geringerer Standardauflösung (z. B. ~768p) diskutiert, sofern keine Upscale-/Regenerierungs-Pfade genutzt werden.
Multimodale Referenzen
Text + Bilder + Video + Audio als Kontext. Community- und Modellnotizen erwähnen häufig Multi-Asset-Referenzen (z. B. mehrere Bilder + Video- + Audioclips) für gezielte Generierung/Bearbeitung.
Open Weights + ComfyUI
Gewichte auf Hugging Face; native ComfyUI-Nodes/-Workflows innerhalb weniger Tage. Die Community liefert bereits Turbo-LoRAs und Quantisierungspakete – klassische Open-Source-Geschwindigkeit.
„Open Kling“ vs. „Open Seedance“ – was auf X tatsächlich gesagt wird
- Offizielle Einordnung: Multimodales Open-Weight-Videomodell von MiniMax / Hailuo – nicht lizenziert oder benannt als Kling.
- Qualitätsdiskussionen in der Community: Häufige Direktvergleiche mit Seedance 2.0 / 2.5 („vergleichbare Qualität“, „Open Seedance“, Arena-Elo-Diskussionen). Als Anekdoten zu betrachten.
- Kling-Vergleiche: stammen aus lockeren Creator-Diskussionen, nicht von MiniMax selbst. „开源版可灵“ nicht als Tatsache veröffentlichen.
- Preiseinschätzung: MiniMax verspricht ein starkes Preis-Leistungs-Verhältnis gegenüber den „gängigen“ proprietären Videomodellen bei 2K/768p – in der eigenen Konsole prüfen; wir übernehmen keine inoffiziellen $/s-Angaben als eigene.
Zugangsübersicht (Stand 2026-08-08)
| Plattform | Status | Hinweise |
|---|---|---|
| MiniMax-Blog / Hailuo-Produkt | Live | Offizieller H3-Beitrag |
| Gehostete API | Live | platform.minimax.io / CN-Konsolen-Dokumentation zur Videogenerierung |
| Hugging Face-Gewichte | Live | MiniMaxAI/MiniMax-H3 · Community-Lizenz (regionale/kommerzielle Klauseln beachten) |
| ComfyUI | Native Unterstützung | Offizielle Workflows + Quantisierungen/Turbo-LoRA aus der Community |
| ChinaModelAPI-Relay | Health-Check ausstehend | Keine erfundenen Modell-IDs – zur Warteliste |
Entwickler-Checkliste
- Weg wählen: gehostete API (2K-Komfort) vs. lokale Gewichte (VRAM + Lizenz).
- Die Community-Lizenz sorgfältig lesen – kommerzielle Schwellenwerte und regionale Einschränkungen tauchen in Repacks der Community auf; maßgeblich ist die offizielle LICENSE-Datei.
- VRAM realistisch einplanen: Vollständige BF16-Stacks, über die in der Community berichtet wird, übersteigen ohne Quantisierung/Pruning oft die Kapazität einer einzelnen Consumer-GPU.
- Kreativ mit Seedance 2.5 für proprietäre Flaggschiff-Qualität und mit dem günstigeren 2.0 Mini für geringe Iterationskosten vergleichen.
- Falls später ein OpenAI-kompatibles Routing für chinesische Videomodelle benötigt wird, auf der ChinaModelAPI-Warteliste bleiben – IDs werden erst veröffentlicht, sobald das Routing funktioniert.
FAQ
H3 or M3?
H3 = Video. M3 = MiniMax Text-LLM. Unterschiedliche Produktlinien.
Open Kling?
Nein. Die Community vergleicht eventuell die Qualität; der Produktname ist die MiniMax H3- / Hailuo-Reihe.
Alles vollständig Open Source?
Basisgewichte sind offen; einige gehostete Komponenten (z. B. Regenerierung in höherer Auflösung / Kontextdienste) bleiben möglicherweise API-exklusiv – Modellkarte prüfen.
Verwandte Themen auf dieser Website
Primärquellen
- MiniMax – MiniMax H3 Launch-Beitrag (2026-07-31)
- Hugging Face – MiniMaxAI/MiniMax-H3
- X: @MiniMax_AI / @Hailuo_AI / @ComfyUI Threads zu Open Weights + Turbo LoRA vom August 2026