Actualite · Outils IA
DeepSeek Harness : l'open source s'attaque à Claude Code, et les prix explosent
15 août 2026 · 5 min de lecture

DeepSeek ne vend plus seulement des modèles moins cher. Le 13 août 2026, le lab chinois a sorti deux choses en même temps : V4-Pro en version officielle, et Harness, un agent de code open source qui veut concurrencer Claude Code. Et à partir du 16 août, les prix de l'API montent. Parfois jusqu'à 4,5 fois.
L'open source reste. Le tarif presque gratuit, lui, part.
Ce qu'est DeepSeek Harness
Harness, c'est le nom court dsh, est un agent de code en terminal et en interface web locale. DeepSeek l'a publié le 13 août 2026 sous licence MIT, en developer preview. Le code est sur GitHub, et il a déjà dépassé 100 000 stars.
Le principe : "tout est un plugin". Le modèle, les outils, les sessions, les sandboxes, le système de fichiers, les boucles d'orchestration, l'interface : chaque composant est remplaçable. Tu veux utiliser Claude au lieu de V4-Pro ? Tu changes le plugin. Tu veux une sandbox différente ? Tu changes le plugin.
Ce que Harness sait faire dès maintenant : inspecter un repo, éditer des fichiers, exécuter des commandes shell, chercher dans des fichiers et sur le web, maintenir un plan, invoquer des skills, déléguer du travail à des sous-agents, et appliquer des politiques d'approbation. C'est ce que fait un agent de code. Claude Code et Codex font la même chose, avec des features en plus (agents hébergés en arrière-plan, intégrations GitHub natives, extensions IDE, apps mobiles).
Lancer Harness tient en une commande : npx @deepseek-ai/dsh web. Ça ouvre une interface web locale où tu sélectionnes un workspace et tu valides les opérations sensibles.
Ce qui change avec V4-Pro
V4-Pro, le modèle flagship de DeepSeek, passe de preview à version officielle. Il est disponible sur l'app, le web et l'API, avec un context window d'un million de tokens et une sortie max de 384K tokens. DeepSeek a ajouté le support natif de l'OpenAI Responses API et l'intégration avec Codex.
Le modèle est décrit comme optimisé pour les tâches agentiques : longues sessions, appels d'outils enchaînés, raisonnement multi-étapes. DeepSeek ne publie pas de benchmarks comparatifs directs contre Claude Sonnet 5 ou GPT-5.6 Terra dans l'annonce. Les benchmarks tiers mettront du temps à arriver.
Le prix : la fin du presque gratuit
C'est la partie qui interpelle. À partir du 16 août 2026 à 16h UTC, DeepSeek remplace son tarif plat par une facturation peak et off-peak. Et les deux tiers sont plus chers qu'aujourd'hui.
| Modèle | Avant | Off-peak | Peak |
|---|---|---|---|
| V4-Pro sortie ($/1M tokens) | 0,87 $ | 1,98 $ | 3,96 $ |
| V4-Pro cache hit ($/1M tokens) | 0,0036 $ | 0,022 $ | 0,044 $ |
| V4-Flash sortie ($/1M tokens) | 0,28 $ | 0,66 $ | 1,32 $ |
Les heures peak sont 01h-04h et 06h-10h UTC, soit 7 heures par jour. Le reste est off-peak. Mais même en off-peak, tout coûte plus cher qu'aujourd'hui. V4-Pro en sortie passe de 0,87 $ à 1,98 $ au minimum. C'est 2,3 fois plus.
Le vrai choc, c'est le cache hit. Les tokens de cache (ceux renvoyés quand l'agent renvoie le contexte accumulé) passent de 0,0036 $ à 0,044 $ en peak. Multiplié par 12. Pourquoi ça compte : les boucles agentiques renvoient le contexte à chaque tour. Un agent qui travaille pendant une heure génère massivement du cache hit. C'était l'avantage de DeepSeek : les agents coûtaient presque rien en cache. Cet avantage rétrécit d'un ordre de grandeur.
DeepSeek reste moins cher que la concurrence en absolu. V4-Pro à 3,96 $ en peak, contre 12 $ pour GPT-5.6 Terra ou 10 $ pour Claude Sonnet 5 en sortie. Mais l'écart se réduit, et DeepSeek a prévenu que les breaking changes sont à prévoir sur Harness.
Un exemple chez Maisons&Mobilia
Sophie, PM chez Maisons&Mobilia (M&M, enseigne de meubles fictive), utilise DeepSeek V4 pour un agent qui génère les fiches produit du catalogue e-commerce. L'agent enchaîne : lire un fichier source, extraire les specs, rédiger la description, vérifier la cohérence, formater en JSON. Chaque fiche prend une dizaine d'appels, avec beaucoup de cache hit parce que le contexte se répète.
Aujourd'hui, traiter 12 000 fiches coûte environ 13 $ par mois en API DeepSeek. Avec les nouveaux tarifs, le même volume coûte entre 27 $ (tout off-peak) et 55 $ (tout peak). Si Sophie bascule sur Claude Sonnet 5, le même volume coûterait plus de 100 $.
L'économie reste réelle, mais elle n'est plus dans un rapport 10x. Le budget doit être modélisé sur les nouveaux prix, pas sur les anciens.
Sophie peut aussi installer Harness pour piloter l'agent en local, sans payer un outil propriétaire. Elle garde le contrôle du modèle (V4-Pro, Claude, ou autre), des outils, et de la sandbox. C'est l'intérêt de l'open source : pas de lock-in sur l'outil, seulement sur le modèle qu'on choisit d'appeler.
Ce que ça change
DeepSeek fait deux choses à la fois. D'un côté, ils ouvrent Harness en open source et s'installent dans la couche outil, là où Anthropic et OpenAI font leur marge. De l'autre, ils montent les prix de leurs modèles.
La stratégie est cohérente. L'open source crée de l'adoption et de la préférence pour l'écosystème DeepSeek. Les prix plus élevés traduisent le fait que V4-Pro est un modèle flagship qui se compare aux meilleurs. DeepSeek ne veut plus être le discount de l'IA. Ils veulent être une alternative complète : modèle + outil, ouverte et moins chère, mais plus gratuitement.
Pour toi, trois choses à retenir. Si tu utilises l'API DeepSeek en production, modélise le coût sur les nouveaux tarifs avant le 16 août. Si tu cherches un agent de code open source, Harness vaut le test (en gardant en tête que c'est une preview). Et si tu compares les coûts des agents IA, l'écart entre DeepSeek et les modèles fermés se réduit, mais ne disparaît pas.
Aller plus loin
Pour comprendre comment un agent de code fonctionne et pourquoi le choix du modèle compte, notre article sur comment fonctionne un agent IA pose les bases. Pour voir comment les prix des modèles influencent le coût d'un agent, le guide sur les familles de modèles compare les approches ouvertes et fermées. Et pour t'entraîner à ces notions en 5 minutes par jour, l'app saisir.ai propose des modules interactifs sur les agents, le tool use et le coût des tokens, en français, sans coder.
Sources
- DeepSeek, "Harness developer preview", 13 août 2026
- VentureBeat, "DeepSeek Harness launches as open source rival to Claude Code", 13 août 2026
- Engadget, "DeepSeek's AI models are about to cost four times more", 14 août 2026
- Codersera, "DeepSeek price change Aug 16, 2026: exact numbers", 14 août 2026
- GitHub, deepseek-ai/deepseek-harness
Questions fréquentes
- C'est quoi DeepSeek Harness ?
- DeepSeek Harness (dsh) est un agent de code open source publie le 13 aout 2026 sous licence MIT. Il fonctionne en terminal et en interface web locale. Son principe : chaque composant (modele, outil, session, sandbox, UI) est un plugin qu'on peut remplacer. Il est concu comme une alternative ouverte a Claude Code et Codex d'OpenAI.
- DeepSeek Harness est-il gratuit ?
- Oui, Harness est open source sous licence MIT. Tu peux le lancer avec npx @deepseek-ai/dsh web. Le code est disponible sur GitHub. Attention : c'est une developer preview avec des breaking changes a prevoir. L'outil est gratuit, mais les modeles qu'il appelle (DeepSeek V4-Pro, Claude, GPT) facturent leur API.
- Pourquoi les prix de l'API DeepSeek augmentent ?
- DeepSeek remplace son tarif plat par une facturation peak/off-peak a partir du 16 aout 2026 a 16h UTC. V4-Pro passe de 0,87 $ a 1,98 $ (off-peak) ou 3,96 $ (peak) par million de tokens en sortie. Les cache hits, qui coutaient presque rien, montent jusqu'a 12x. DeepSeek reste moins cher que Claude ou GPT, mais l'ecart se reduit.
- DeepSeek Harness peut-il remplacer Claude Code ?
- Pas encore. Harness sait lire un repo, editer des fichiers, executer des commandes shell, chercher, planifier et deleguer a des sous-agents. Mais Claude Code et Codex offrent plus : agents en arriere-plan heberges, integrations GitHub native, extensions IDE, apps mobiles. Harness est une developer preview, pas un produit fini.
- Quels modeles peut-on utiliser avec DeepSeek Harness ?
- Harness est model-agnostic : il supporte les modeles DeepSeek (V4-Pro, V4-Flash), Anthropic (Claude), OpenAI (GPT) et tout endpoint compatible. Tu peux changer de modele comme on change un plugin, sans recrire ton agent.