← L'édition
IANouveau4 min de lecture

DeepSeek V4 Pro 0813 arrive sur OpenRouter, avec un vrai sujet pour les agents de code

DeepSeek a mis en ligne **V4 Pro 0813** le **12 août 2026**, mais sans page d’annonce officielle dédiée : la disponibilité est visible chez OpenRouter et dans l’écosystème DeepSeek existant. Pour les développeurs, l’intérêt n’est pas seulement le nouveau nom de version : c’est surtout la combinaison **API only**, **contexte de 1 million de tokens** (jetons, morceaux de texte traités par le modèle) et **réglage fin du niveau de raisonnement** qui peut changer le comportement d’un assistant ou d’un agent de code.

Fil « Nouveau DeepSeek V4 Pro »

DeepSeek V4 Pro 0813 est désormais listé sur OpenRouter comme la version GA (general availability, c’est-à-dire version officiellement exploitable en production) de DeepSeek V4 Pro, avec une sortie datée du 12 août 2026, un contexte de 1M (jusqu’à un million de jetons en entrée) et un tarif affiché de 0,435 $ en entrée et 0,87 $ en sortie par million de jetons. Simon Willison note que le modèle est disponible via API uniquement et précise qu’il n’a pas trouvé d’annonce officielle DeepSeek spécifique à cette révision 0813. (openrouter.ai)

Ce qui change concrètement pour une équipe qui code avec de l’IA

Le point le plus pratique n’est pas marketing : DeepSeek documente un mode “thinking” (mode de raisonnement interne) activé par défaut sur V4, avec un paramètre reasoning_effort réglable sur low, high ou max. En clair, vous pouvez demander au modèle de réfléchir plus ou moins longtemps avant de répondre. Sur des usages de développement, cela change directement le compromis entre latence (temps de réponse), coût et qualité sur des tâches comme la lecture d’un gros dépôt, la génération de correctifs ou l’orchestration d’outils. (api-docs.deepseek.com)

Autre point important pour les agents : DeepSeek indique que le mode de raisonnement supporte les appels d’outils (tool calls, c’est-à-dire la capacité du modèle à demander l’exécution d’une commande, d’une recherche ou d’une fonction). Mais il y a une contrainte d’intégration : si votre application envoie des outils dans la requête, vous devez renvoyer intégralement reasoning_content (le contenu de raisonnement produit par le modèle) aux tours suivants, sinon l’API retourne une erreur 400. C’est un détail d’implémentation, mais c’est exactement le genre de détail qui casse un agent en production si votre passerelle OpenAI-compatible ou votre SDK ne le propage pas correctement. (api-docs.deepseek.com)

Ce que l’on sait — et ce qu’on ne sait pas encore

Sur l’ouverture des poids (open weights, c’est-à-dire la publication des fichiers du modèle pour exécution locale ou auto-hébergement), il n’y a pas de confirmation trouvée pour V4 Pro 0813 lui-même. En revanche, Simon Willison rappelle que les poids de DeepSeek-V4-Pro publiés en avril 2026 existent déjà sur Hugging Face, tout comme ceux de DeepSeek-V4-Flash-0731 publiés ensuite. DeepSeek avait en effet annoncé le 24 avril 2026 que DeepSeek-V4 Preview était “open-sourced” (publié en poids ouverts) et donnait pour V4 Pro une architecture à 1,6 trillion de paramètres totaux pour 49 milliards de paramètres actifs (paramètres réellement mobilisés à chaque réponse dans une architecture MoE, mixture-of-experts, c’est-à-dire un modèle qui n’active qu’une partie de ses sous-réseaux). Mais aucune source consultée ici ne confirme encore que la révision 0813 sera elle aussi publiée sous cette forme. (simonwillison.net)

Pourquoi ça mérite votre attention maintenant

Pour un développeur, le signal utile est le suivant : DeepSeek continue à pousser une famille V4 pensée pour les agents de code et les flux multi-outils, avec un contexte long par défaut et des interfaces compatibles OpenAI ChatCompletions et Anthropic dans sa documentation officielle. DeepSeek avait déjà positionné V4 sur les usages “agentic coding” (codage agentique, c’est-à-dire des assistants capables d’enchaîner raisonnement, appels d’outils et modifications de code), et sa documentation montre que la pile API V4 est structurée autour de ces usages. Si votre équipe teste plusieurs fournisseurs derrière une couche unique comme OpenRouter, V4 Pro 0813 ressemble donc moins à une simple mise à jour incrémentale qu’à une version à surveiller pour les workflows où l’agent doit conserver beaucoup de contexte et piloter des outils proprement. (api-docs.deepseek.com)

{
  "model": "deepseek-v4-pro",
  "messages": [
    {"role": "user", "content": "Analyse ce dépôt et propose un plan de refactorisation"}
  ],
  "reasoning_effort": "high",
  "extra_body": {
    "thinking": {"type": "enabled"}
  }
}

En pratique, la bonne question n’est pas “est-ce que DeepSeek a sorti un nouveau modèle ?”, mais “est-ce que ma pile d’agent transmet correctement le mode de raisonnement et le contexte multi-tour ?”. Si la réponse est non, vous risquez de payer pour un modèle plus capable sans bénéficier de ce qui fait précisément sa différence. (api-docs.deepseek.com)