ChinaModelAPI
Aktualisiert 2026-07-27 · Leitfaden

Kimi K3 API — Moonshot-Flaggschiff-Schnellstart

Kimi K3 ist das Flaggschiff von Moonshot AI aus dem Juli 2026: ~2,8 Billionen Parameter, 1M-Token-Kontext, native Vision – ein offenes Modell der 3T-Klasse für Long-Horizon-Coding, Wissensarbeit und Multi-Agenten-Systeme.

Direkte Antwort (Juli 2026)

Aktuelles Flaggschiff = Kimi K3 (keine reine K2 / moonshot-v1-Positionierung). Nutzen Sie model="kimi-k3" (Dashboard-Alias prüfen) unter https://api.chinamodelapi.com/v1. API-Produktdokumentation: Moonshot / platform.kimi.ai; die Veröffentlichung der Open Weights war für Ende Juli 2026 geplant.

Quellen: CNBC / VentureBeat / Berichterstattung zum Moonshot-Launch (Mitte Juli 2026); X-Diskussion über den Weight-Drop ~2026-07-27.

Wichtige Spezifikationen für Entwickler

  • ~2.8T Parameter — stärkstes Narrativ für ein chinesisches Open-Class-Frontier-Modell in der Berichterstattung vom Juli 2026
  • 1M-Token-Kontext — dateiübergreifende Repositories, Research-Pakete, lange Agenten-Trajektorien
  • Native Vision — multimodale Eingabe in der K3-Generation
  • Vorgängerfamilie — K2.7 Code / K2.x weiterhin relevant für günstigere Coding-Workloads

Wann K3 im Vergleich zu anderen gewählt werden sollte

BedarfBevorzugt für
Maximaler Long-Horizon-Agent / riesiger Kontextkimi-k3
Open-Weight-Coding-Harness, Self-Hostingglm-5.2 (Gewichte) oder K3, sobald die Gewichte verfügbar sind
Günstigste kurze Chats / RAG-Antwortendeepseek-v4-pro / GLM-Flash-Tarife
Mehrsprachiger Allrounder + 1M Qwen-Stackqwen-plus / qwen-max-Familie

Kimi-Modellreihe & Preise (August 2026)

Heute lohnt es sich, Anfragen an zwei Kimi-Generationen weiterzuleiten: K3 ist die Frontier-Wahl; K2.5 ist die Preis-Leistungs-Wahl für Agenten-Schleifen, die keinen 1M-Kontext benötigen. Frühere K2.x-Modelle bleiben verfügbar, sind aber weitgehend überholt.

ModellKontextEingabe $/1MAusgabe $/1MOptimal für
kimi-k31M$3.00$15.00Long-Horizon-Agenten, native Vision, dateiübergreifendes Coding
kimi-k2.5262K$0.45$2.25Tool-Use-Traces, Agenten-Schleifen zu ~6.7x niedrigeren Kosten

Offizielle Listenpreise verifiziert am 23.08.2026 (platform.kimi.ai; K2.5 via OpenRouter-Eintrag). Siehe die vollständige Preistabelle für die günstigsten chinesischen LLMs, um zu sehen, wie Kimi im Vergleich zu DeepSeek, GLM und Qwen abschneidet.

Adoptionssignal: Kimi K3 verarbeitet bereits Produktions-Workloads – siehe den Wechsel von Harvey Tenet zu einer Kimi K3-Basis und die Analyse des K3 + GLM-5.2 Open-Stacks.

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[
        {"role": "system", "content": "You are a long-horizon coding agent. Cite file paths."},
        {"role": "user", "content": f"REPO CONTEXT:\n{repo_blob}\n\nTASK: fix flaky integration tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Kostentipp

K3 ist im Vergleich zu Flash-Modellen im Frontier-Preissegment angesiedelt. Zuerst abrufen (Retrieve first), den Kontext nur erweitern, wenn die Konfidenz gering ist. Verwenden Sie K2.x / DeepSeek-V3 / GLM für die 80 % kurzen Interaktionen; reservieren Sie K3 für anspruchsvolle Aufgaben mit mehreren Dateien oder Dokumenten.

FAQ

Basiert Kimi noch auf K2?

K2.x bleibt weiterhin Teil der Modellfamilie, aber das Flaggschiff vom Juli 2026 ist Kimi K3. Auf Produktseiten sollte K3 an erster Stelle stehen.

Wie groß ist K3?

Öffentliche Berichte beschreiben ~2.8T Parameter und ein Kontextfenster von 1M Token mit nativer Vision.

Offene Gewichte?

Moonshot kündigte Open Weights für K3 an (in einigen Berichten modifizierte MIT-Lizenz), mit einer Veröffentlichung der Gewichte gegen Ende Juli 2026. Bis Self-Hosting praktikabel ist, nutzen Sie den API-Zugang.

K3 vs. GLM-5.2?

Beides sind chinesische Frontier-Releases aus dem Jahr 2026. K3 setzt auf eine Skalierung der 3T-Klasse + langen Kontext + Vision; GLM-5.2 legt den Schwerpunkt auf Long-Horizon-Coding mit weit verbreiteten Open Weights (sein Nachfolger GLM-5.3 vom August 2026 setzt noch stärker auf Coding/Agenten). Führen Sie Ihr eigenes Eval-Harness aus.

Was kostet Kimi pro Million Token?

Offizielle Liste (verifiziert 2026-08-23): Kimi K3 liegt bei $3.00 Input / $15.00 Output pro 1M Token mit 1M-Kontext; Kimi K2.5 liegt bei $0.45 / $2.25 mit 262K-Kontext. Eine K2.5-Agenten-Schleife kostet etwa ein Sechstel desselben Volumens auf K3.

K2.5 oder K3 für Agenten-Schleifen?

Leiten Sie Tool-Use-Traces und routinemäßige Agenten-Schritte an K2.5 weiter, und eskalieren Sie die schwierigen datei- oder dokumentübergreifenden Schritte zu K3. Die OpenAI-kompatible Modell-ID ist das Einzige, was sich dabei ändert.

Verwandte Leitfäden