Actualités / Model Watch · Outillage
DeepSeek Harness v0.1 : DeepSeek publie son harnais d'agent en open source
Quelques heures après le lancement de DeepSeek-V4-Pro-0813, DeepSeek a publié Harness v0.1 en Developer Preview — le framework d'agent open source sous licence MIT qu'elle utilise pour évaluer ses propres modèles. La presse internationale l'a rapidement présenté comme un rival open source de Claude Code et OpenAI Codex. Voici ce qu'il en est réellement, ce que révèlent les premiers tests pratiques et ce que les développeurs d'API doivent en retenir.
Mise à jour · 2026-08-20 : Harness a franchi ses premières étapes multimodales — la rc.7 (17 août) a ajouté les pièces jointes d'images persistantes pour MCP/ACP ; la rc.8 (19 août) a intégré les requêtes d'images natives configurables pour les adaptateurs DeepSeek ainsi que la saisie d'images pour /goal et /plan. Les modèles V4 de DeepSeek restent quant à eux limités au texte. Lire le point d'étape complet →
DeepSeek Harness (dsh) est un harnais d'agent gratuit, sous licence MIT, exécutable en local — et indépendant du modèle.
Annoncé par le compte X officiel de DeepSeek le 13 août 2026 (21:02 UTC+8) et publié sur
github.com/deepseek-ai/deepseek-harness.
Tout — outils, sandbox, sessions, interface — est un plugin interchangeable reposant sur le système de plugins Cordis. Lancez-le avec
npx @deepseek-ai/dsh web (interface Web sur 127.0.0.1:3080).
Il s'agit d'une préversion développeur v0.1 avec des ruptures de compatibilité annoncées — évaluez-la, mais ne misez pas encore votre production dessus.
Ce qui a été livré, selon les sources officielles
| Élément | Détail |
|---|---|
| De quoi s'agit-il | DeepSeek Harness v0.1 — Developer Preview d'un harnais d'agent open source (dsh) |
| Quand | Annoncé le 2026-08-13 à 21:02 (UTC+8) sur X ; dépôt public le soir même |
| Licence | MIT |
| Architecture | « Tout est un plugin » sur Cordis ; outils / sandbox / sessions / interface tous remplaçables |
| Lancement | npx @deepseek-ai/dsh web → interface Web locale sur 127.0.0.1:3080 |
| Mise en garde sur le statut | Itérations rapides ; « THERE WILL BE COMPATIBILITY-BREAKING CHANGES » (README) |
| Intégration à la doc officielle | Le changelog de l'API DeepSeek indique que les benchmarks publics de V4-Flash ont été exécutés en « mode minimal » de Harness ; la barre latérale de la documentation renvoie désormais vers celle du harnais |
Le même soir, DeepSeek-V4-Pro-0813 est passé en disponibilité générale (GA) sur l'application/le web/l'API avec la prise en charge native de l'API Responses et l'adaptation à Codex — voir notre point sur la version 0813 ; la tarification heures pleines / heures creuses entre en vigueur le 16 août à 16:00 UTC.
Ce qu'en dit la presse internationale
- VentureBeat a résumé le lancement sans détour : un « rival open source de Claude Code » arrivant aux côtés de V4-Pro sur l'API « avec des prix plus élevés » — la double actualité de la semaine : des outils moins chers, des tokens de pointe plus onéreux.
- The Decoder met en avant l'architecture et les origines du projet : « toutes les fonctionnalités sont des plugins interchangeables » sur le système Cordis récemment publié ; les journaux de session persistants enregistrent chaque prompt, appel d'outil et résultat, avec des exécutions qui peuvent être reprises, dérivées en branches et rejouées ; le mode minimal ne conserve qu'un shell et un éditeur de fichiers — la configuration utilisée par DeepSeek elle-même pour ses benchmarks. L'article note également que le responsable du projet est Cui Tianyi, qui a rejoint DeepSeek en provenance de Jane Street en mars 2026, et que l'appel à testeurs a suscité 712 candidatures en trois jours.
- 36Kr (anglais) a réalisé un test pratique d'une nuit avec une thèse tranchée — « Ce n'est pas un simple Claude Code de plus, il est là pour éliminer Claude Code » — et des observations concrètes : quatre modes de fonctionnement (standard ; PTC, où le modèle écrit du TypeScript fusionnant ~10 tours d'appels d'outils en une seule exécution ; minimal pour les benchmarks ; et un mode création pour concevoir de nouveaux modes) ; des logs de trajectoire en ajout seul (append-only) ; 288 dépôts de plugins en 24 heures ; le remplacement à chaud de plus de 20 plugins sans aucun redémarrage grâce au suivi des effets de bord réversibles de Cordis ; et l'import de sessions depuis Claude Code, opencode et Antigravity qui « a fonctionné à la perfection ». Sa remarque la plus incisive : le modèle ne bénéficie d'aucun traitement privilégié — « Les propres modèles de DeepSeek ne font pas exception. Ils ne sont qu'un plugin parmi d'autres. »
- Pandaily l'a qualifié de probable « projet d'agent open source le plus ambitieux de l'année », structuré autour de l'équation Modèle + Harnais = Agent.
- Reddit (r/LocalLLaMA, r/DeepSeek) a relayé le dépôt immédiatement ; les fils de discussion de la communauté soulignent les versions Desktop/CLI et le fait que les benchmarks d'agents publiés par DeepSeek s'exécutent tous via ce harnais.
- SCMP avait précédemment rapporté que DeepSeek « renforce son IA agentique avec des tests de harnais » — un contexte utile montrant que cette sortie était attendue et non improvisée.
Pourquoi c'est important pour une stack de modèles chinois
- Le harnais est gratuit ; le coût réside dans les tokens. Avec le passage de V4-Pro à une tarification heures pleines / heures creuses (heures creuses : 0,66 $ en entrée / 1,98 $ en sortie par 1M ; le double en heures pleines ; la plus forte hausse concernant le cache — d'après la lecture de la grille officielle par The Decoder), l'économie des boucles d'agents s'oriente vers des modèles plus économiques et open-weight pour le travail de masse. C'est exactement là qu'une passerelle multi-modèles compatible OpenAI prend tout son sens.
- Agnostique quant au modèle par conception. La couche modèle est un plugin ; des plugins de routage communautaires existent déjà. Pointer
dshvers un endpoint compatible OpenAI (paliers DeepSeek, Qwen, GLM, Kimi) est le fonctionnement prévu, pas un hack — vérifiez les conditions de votre fournisseur et la prise en charge du tool-calling par modèle. - Les logs de trajectoire constituent une avancée pour le débogage. Les journaux en ajout seul (append-only) avec reprise, embranchement et relecture rendent les longues exécutions d'agents auditables — précieux lorsque vous effectuez des tests A/B pour déterminer quel modèle frontière chinois gère le mieux vos tâches à l'échelle d'un dépôt.
- L'import de sessions réduit le coût de migration. Si vous avez un historique sur Claude Code ou opencode, le test pratique de 36Kr montre que vous pouvez le reprendre — bon à savoir avant votre prochain choix de harnais.
- Ne migrez pas encore votre production. Il s'agit d'une préversion v0.1 avec des ruptures de compatibilité annoncées, et une grande partie de l'expérience utilisateur dépend actuellement de plugins communautaires évoluant rapidement et de qualité inégale. Testez-le en sandbox, évaluez-le avec vos benchmarks et faites le point à partir de la v0.2+.
Sources primaires
- github.com/deepseek-ai/deepseek-harness (dépôt officiel : licence MIT, developer preview, Cordis, instructions de lancement)
- DeepSeek sur X — Annonce de la Developer Preview de Harness v0.1 (2026-08-13)
- Changelog de l'API DeepSeek — GA de V4-Pro-0813, note sur le benchmark en mode minimal de Harness, tarifs du 16 août
- The Decoder — DeepSeek lance un modèle V4 Pro amélioré, augmente les prix de son API et passe son logiciel d'agent en open source
- VentureBeat — DeepSeek Harness se lance en tant que rival open source de Claude Code
- 36Kr English — Après avoir testé DeepSeek Harness toute la nuit (quatre modes, plugins, import de session)
- Pandaily — Prise en main de DeepSeek Harness : quatre modes de travail, Modèle + Harnais = Agent
- SCMP — DeepSeek renforce son IA agentique avec des tests de harnais (contexte pré-lancement)
FAQ
DeepSeek Harness est-il gratuit ?
Le harnais lui-même est gratuit et sous licence MIT. Vous payez pour les tokens du modèle — via l'API DeepSeek ou tout fournisseur compatible OpenAI vers lequel vous le routez.
Le tueur de Claude Code ?
Les tests pratiques internationaux sont impressionnés mais lucides : v0.1, ruptures de compatibilité annoncées, qualité inégale des plugins. C'est le premier harnais ouvert issu d'un laboratoire de pointe doté d'une architecture interne de niveau benchmark — un concurrent crédible, pas un remplaçant à ce jour.
Puis-je l'utiliser avec Qwen / GLM / Kimi ?
D'un point de vue architectural, oui — le modèle n'est qu'un plugin supplémentaire et des plugins de routage existent. Vérifiez la prise en charge du tool-calling et les conditions d'utilisation selon le fournisseur ; les utilisateurs de ChinaModelAPI doivent vérifier les identifiants de modèles actifs dans le tableau de bord.
Qu'est-ce que le « mode minimal » ?
Shell + éditeur de fichiers uniquement, sans fonctionnalités superflues — la configuration utilisée par DeepSeek pour évaluer les performances brutes du modèle. À utiliser pour obtenir des chiffres comparables entre modèles.