ChinaModelAPI
Mis à jour le 2026-07-27 · Guide

API Kimi K3 — Prise en main rapide du modèle phare de Moonshot

Kimi K3 est le modèle phare de juillet 2026 de Moonshot AI : ~2.8T paramètres, contexte de 1M de tokens, vision native — un modèle ouvert de classe 3T pour le codage à long horizon, le travail intellectuel et les systèmes multi-agents.

Réponse directe (juillet 2026)

Modèle phare actuel = Kimi K3 (et non un positionnement réservé à K2 / moonshot-v1). Utilisez model="kimi-k3" (vérifiez l'alias sur le tableau de bord) avec https://api.chinamodelapi.com/v1. Documentation produit de l'API : Moonshot / platform.kimi.ai ; le déploiement des poids ouverts était prévu vers fin juillet 2026.

Sources : couverture du lancement par CNBC / VentureBeat / Moonshot (mi-juillet 2026) ; discussions sur X concernant la mise à disposition des poids vers le 2026-07-27.

Spécifications clés pour les développeurs

  • ~2.8T paramètres — plus grand modèle frontière chinois de classe ouverte selon la couverture de juillet 2026
  • Contexte de 1M de tokens — dépôts multi-fichiers, dossiers de recherche, longues trajectoires d'agents
  • Vision native — entrée multimodale dans la génération K3
  • Famille précédente — K2.7 Code / K2.x toujours pertinent pour des charges de travail de codage plus économiques

Quand choisir K3 par rapport aux autres

BesoinPrivilégier
Agent à long horizon maximal / contexte gigantesquekimi-k3
Environnement de codage en poids ouverts, auto-hébergementglm-5.2 (poids) ou K3 dès la sortie des poids
Chat court le plus économique / réponse RAGdeepseek-v4-pro / offres flash GLM
Généraliste multilingue + stack Qwen 1Mfamille qwen-plus / qwen-max

Gamme Kimi & tarifs (août 2026)

Deux générations de Kimi méritent d'être ciblées aujourd'hui. K3 est le choix de pointe ; K2.5 est le choix économique pour les boucles d'agents qui n'ont pas besoin d'un contexte de 1M. L'ancienne gamme K2.x reste disponible mais est globalement dépassée.

ModèleContexteEntrée $/1MSortie $/1MIdéal pour
kimi-k31M$3.00$15.00Agents à long horizon, vision native, codage multi-fichiers
kimi-k2.5262K$0.45$2.25Traces d'utilisation d'outils, boucles d'agents à un coût ~6.7x inférieur

Tarifs officiels vérifiés le 2026-08-23 (platform.kimi.ai ; K2.5 via le catalogue OpenRouter). Consultez le tableau complet des prix des LLM chinois les moins chers pour voir où se situe Kimi par rapport à DeepSeek, GLM et Qwen.

Signal d'adoption : Kimi K3 exécute déjà des charges de travail en production — voir la transition de Harvey Tenet vers une base Kimi K3 et le décryptage de la stack ouverte K3 + GLM-5.2.

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[
        {"role": "system", "content": "You are a long-horizon coding agent. Cite file paths."},
        {"role": "user", "content": f"REPO CONTEXT:\n{repo_blob}\n\nTASK: fix flaky integration tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Conseil d'optimisation des coûts

K3 a une tarification de modèle frontière par rapport aux modèles Flash. Effectuez d'abord une recherche, et n'élargissez le contexte que lorsque le niveau de confiance est faible. Utilisez K2.x / DeepSeek-V3 / GLM pour 80 % des échanges courts ; réservez K3 pour les tâches multi-fichiers ou multi-documents complexes.

FAQ

Kimi est-il toujours sur K2 ?

K2.x fait toujours partie de la gamme, mais le modèle phare de juillet 2026 est Kimi K3. Les pages produits devraient mettre K3 en avant.

Quelle est la taille de K3 ?

Les publications publiques décrivent ~2.8T paramètres et une fenêtre de contexte de 1M de tokens, avec vision native.

Poids ouverts ?

Moonshot a annoncé des poids ouverts pour K3 (licence MIT modifiée dans certaines publications) avec une diffusion des poids vers fin juillet 2026. Tant que l'auto-hébergement n'est pas pratique, utilisez l'accès API.

K3 vs GLM-5.2 ?

Les deux sont des lancements de modèles frontières chinois de 2026. K3 mise sur une échelle de classe 3T + un long contexte + la vision ; GLM-5.2 met l'accent sur le codage à long horizon avec des poids ouverts largement adoptés (son successeur d'août 2026, GLM-5.3, renforce encore le codage et les agents). Testez-les sur votre propre banc d'évaluation.

Combien coûte Kimi par million de tokens ?

Tarifs officiels (vérifiés le 2026-08-23) : Kimi K3 est à $3.00 en entrée / $15.00 en sortie par million de tokens avec 1M de contexte ; Kimi K2.5 est à $0.45 / $2.25 avec 262K de contexte. Une boucle d'agent sur K2.5 coûte environ un sixième du même volume sur K3.

K2.5 ou K3 pour les boucles d'agents ?

Acheminez les traces d'utilisation d'outils et les échanges d'agents de routine vers K2.5, réservez les étapes complexes multi-fichiers ou multi-documents pour K3. L'identifiant de modèle compatible OpenAI est le seul élément qui change entre les deux.

Guides associés