Actualités / Veille hebdomadaire des modèles
Page évolutive — mise à jour chaque semaine. Instantané des données actuelles : semaine du 2026-08-20.
Veille des modèles chinois — État hebdomadaire des modèles d'IA chinois
Instantané du registre issu du tableau des modèles phares de ChinaModelAPI (au 2026-08-20). Cette publication correspond au rythme hebdomadaire automatisé pour la fraîcheur SEO/GEO — elle n'invente aucune nouvelle version de modèle.
Stack chinoise actuelle que nous suivons pour les développeurs d'API : Qwen3.8-Max-Preview · DeepSeek-V4-Pro · DeepSeek-V4-Flash · GLM-5.2 · Kimi K3…. Les références occidentales de comparaison restent GPT-5.6 Sol et Claude Opus 5. Le choix par défaut en production pour la vidéo reste Seedance 2.0, tandis que la 2.5 se situe dans une fenêtre en août, sauf si la GA est confirmée.
Modèles chinois (suivis)
| Modèle | Créateur | Notes |
|---|---|---|
| Qwen3.8-Max-Preview | Alibaba | 1M |
| DeepSeek-V4-Pro-0813 | DeepSeek | Version finale (GA) 2026-08-13 ; agents améliorés ; identifiant de modèle deepseek-v4-pro inchangé ; ajustement mineur du prix de l'API. Harness v0.1 (dsh) open-source le 2026-08-13 au soir : harness d'agents dev-preview sous licence MIT, tout est un plugin sur Cordis ; mode minimal = framework de benchmark officiel. Harness multimodal (au 08-20) : rc.7 (08-17) pièces jointes d'images persistantes MCP/ACP ; rc.8 (08-19) requêtes d'images natives configurables pour les adaptateurs DeepSeek + entrée d'image pour /goal //plan ; npm latest=rc.7, rc.8 sur next ; V4-Pro/V4-Flash restent text-only (changelog officiel de l'API inchangé depuis le 08-13). |
| DeepSeek-V4-Flash | DeepSeek | 1M |
| GLM-5.2 (prod) / GLM-5.3 (sorti le 08-14) | Zhipu/Z.ai | Mise à jour GLM-5.3 (au 08-19) : tarifs API publiés sur docs.z.ai international USD — $1.40 entrée / $0.26 en cache / $4.40 sortie par 1M, identique à 5.2 ; OpenRouter a affiché le même prix le 08-18. Première évaluation indépendante : Artificial Analysis II v4.1.1 = 60, rang 8/182 (effort max 59.5 contre Kimi K3 59.7 / GPT-5.6 Sol 60.9 / Opus 5 61.5), signalé comme 'très verbeux' (170M contre 72M tokens médians sur le run d'index). Les poids ne sont PAS encore sur HF zai-org (vérifié le 08-19), attendus vers le 08-28 après renforcement de la sécurité. Chiffres du fournisseur : Terminal-Bench 3.0 4.6→28.3, DeepSWE 46.2→66.9, CyberGym 84.5%, 2,436 vulnérabilités réelles (1,097 critiques/hautes selon le graphique). Changement cassant de l'API : thinking.type 'disabled' supprimé. Presse anglophone : VentureBeat (revendication de vulnérabilité Cursor, non confirmée), The Decoder, Interconnects (~750B paramètres, ~$1B ARR selon les informations), Reuters (accès de confiance), fil HN à 1,167 points. La production reste sur glm-5.2 jusqu'à la GA de 5.3 et un fonctionnement stable via les relais. |
| Kimi K3 | Moonshot | 1M |
| Seedance 2.0 (prod) / 2.5 (fenêtre d'août) | ByteDance | 2.5 : ~30s en natif ; accès anticipé 年框 ; GA repoussée de début/mi-juillet vers août |
| HappyHorse | Alibaba | vidéo |
Références occidentales
| Modèle | Créateur | Notes |
|---|---|---|
| GPT-5.6 Sol | OpenAI | Niveau phare Sol ; Terra/Luna plus abordables |
| Claude Opus 5 | Anthropic | Gamme Opus ; Sonnet 5 milieu de gamme |
| Grok 4.6 | xAI | Listé dans la documentation officielle de xAI comme modèle phare recommandé ; contexte de 500k ; $2/$6 par 1M (<200k prompt) ; date limite des connaissances au 2026-02-01. Référence occidentale uniquement — non routé par ChinaModelAPI. |
| Gemini 3.7 Flash | Annoncé le 2026-08-13 (3 semaines après 3.6 Flash) ; 'bête de somme la plus intelligente' pour le code + agents ; gemini-3.7-flash stable dans la documentation de l'API Gemini ; 1,048,576 entrée / 65,536 sortie ; réflexion low/med/high ; benchmarks du fournisseur DeepSWE 65.3% / FrontierCode 43.6% ; prix de lancement à $0.75/$3.75 par 1M jusqu'au 2026-12-31, puis $1.50/$7.50. Référence occidentale uniquement — non routé par ChinaModelAPI. |
Comment fonctionne cette automatisation
- Hebdomadaire (lun.) — publication automatique de cet instantané à partir de
data/model-watch/current-flagships.json. - Analyses approfondies — rédigées lorsque les modèles phares changent ou lorsqu'une session de recherche remplit
draft-*.md. - Politique des sources — documentations officielles en priorité ; X uniquement pour la découverte. Cette publication automatique ne scrappe pas les flux sociaux.