Une version finale disponible sans changer le nom du modèle
DeepSeek a annoncé le 13 août 2026 le passage de V4 Pro en disponibilité générale. La mise à jour est déployée dans l’application, sur le web et dans l’API. Pour les développeurs, le nom deepseek-v4-pro ne change pas : les appels existants utilisant ce modèle doivent recevoir la nouvelle révision, identifiée comme DeepSeek-V4-Pro-0813 dans la documentation tarifaire. Il s’agit de la finalisation du modèle présenté en preview le 24 avril, pas du lancement d’une famille V5 ni d’un nouveau produit local.
La fiche officielle conserve une fenêtre de contexte annoncée à un million de tokens et une sortie maximale de 384 000 tokens. V4 Pro prend en charge les modes avec et sans raisonnement, les sorties JSON, les appels d’outils, l’API au format Anthropic et désormais l’API Responses au format OpenAI. Les trois niveaux d’effort de raisonnement — low, high et max — permettent de privilégier la latence ou la profondeur du traitement selon la tâche. La complétion FIM reste toutefois limitée au mode sans raisonnement et toujours marquée comme bêta.
Deux dates doivent être distinguées. Le modèle final est disponible depuis le 13 août. La nouvelle grille de prix, elle, ne prendra effet que le 16 août à 16 h UTC, soit 18 h en Belgique pendant l’heure d’été. Jusqu’à cette bascule, la documentation affiche encore l’ancien tarif de V4 Pro : 0,003625 dollar par million de tokens d’entrée trouvés en cache, 0,435 dollar sans cache et 0,87 dollar en sortie.
Des progrès orientés agents, mais mesurés par DeepSeek
DeepSeek met surtout en avant les tâches d’agent. L’entreprise publie 87,9 sur Terminal Bench 2.1, 62,7 sur DeepSWE, 61,5 sur NL2Repo, 74,1 sur Toolathlon-Verified et 31,8 sur la partie publique d’AutomationBench. Humanity’s Last Exam est donné à 42,7 sans outils et 60,0 avec outils. Ces résultats suggèrent un modèle mieux adapté aux longues chaînes d’actions, à l’ingénierie logicielle et à l’utilisation d’outils qu’une simple mise à jour de conversation.
Ils ne constituent pourtant pas un benchmark indépendant. DeepSeek ne fournit pas, dans l’annonce, un protocole complet pour chaque score, le coût total en tokens, la latence, le nombre de tentatives ou une comparaison homogène avec tous les concurrents. DSBench-FullStack et DSBench-Hard, annoncés respectivement à 71,1 et 67,2, sont en outre des jeux de tests internes. Great Opti ne peut donc pas convertir ces valeurs en gain universel de productivité ni en classement général.

Le support natif de Responses API est plus concret à court terme. DeepSeek fournit une configuration destinée à Codex CLI, à l’application de bureau ChatGPT et à l’extension Codex pour VS Code. Cela peut réduire les adaptations nécessaires pour tester V4 Pro dans un flux de développement déjà fondé sur ce protocole. La compatibilité d’interface ne garantit cependant ni la parité avec les modèles intégrés au service, ni un comportement identique pour chaque outil, commande ou politique de sécurité.
Une hausse très variable selon l’heure et le type de token
À partir du 16 août, DeepSeek séparera les heures de pointe et les heures creuses. Pour V4 Pro, un million de tokens de sortie coûtera 1,98 dollar hors pointe et 3,96 dollars en pointe, contre 0,87 dollar auparavant. L’entrée sans cache passera de 0,435 dollar à 0,66 ou 1,32 dollar. L’entrée trouvée en cache augmentera plus fortement, de 0,003625 dollar à 0,022 ou 0,044 dollar. Résumer la modification à un tarif simplement quadruplé serait donc imprécis : le multiplicateur dépend du sens du trafic, du cache et de l’heure.

Les plages de pointe sont fixées de 1 h à 4 h UTC et de 6 h à 10 h UTC. En Belgique le 16 août, cela correspond à 3 h–6 h et 8 h–12 h ; toutes les autres heures sont hors pointe. Les traitements différables, comme certaines analyses nocturnes ou générations par lots, pourront donc être planifiés en dehors de ces créneaux. Un agent interactif utilisé le matin ne dispose pas toujours de cette souplesse et devra être budgété au tarif maximal.
V4 Flash est concerné par la même logique. Sa sortie passera de 0,28 dollar par million de tokens à 0,66 dollar hors pointe ou 1,32 dollar en pointe. Le choix entre Flash et Pro ne doit pas reposer uniquement sur le prix unitaire : la qualité obtenue, le nombre de relances, la longueur des réponses et les limites de concurrence influencent le coût réel d’une tâche terminée.
Ce qu’il faut vérifier avant une migration ou un déploiement
DeepSeek limite par défaut V4 Pro à 500 requêtes simultanées par compte, contre 2 500 pour V4 Flash. Une requête excédentaire peut recevoir une erreur HTTP 429, même si plusieurs clés API sont utilisées sous le même compte. Une équipe doit donc mesurer le débit, la durée des réponses, l’efficacité réelle du cache et les reprises après erreur sur sa propre charge. La fenêtre de contexte maximale n’implique pas que chaque requête longue sera économique ou plus fiable.
La documentation Codex propose un script automatique qui modifie des fichiers de configuration locaux et demande une clé API. Il est préférable d’auditer ce script avant exécution, de sauvegarder sa configuration et de ne jamais coller une clé dans un dépôt ou un journal. Une méthode manuelle est également documentée. Cette intégration est facultative : la sortie de V4 Pro n’oblige pas un utilisateur de Codex ou d’un autre agent à remplacer son fournisseur actuel.
Enfin, l’annonce ne publie pas de mesures indépendantes sur la sûreté, la confidentialité, la résidence des données, la stabilité en production ou le coût d’un projet complet. Elle ne confirme pas non plus la mise à disposition de nouveaux poids locaux correspondant précisément à la révision 0813. Pour une entreprise européenne, les conditions contractuelles, la politique de traitement des données et les exigences réglementaires doivent être vérifiées séparément avant d’envoyer du code ou des documents sensibles.

Commentaires
Chargement…
Préparation de votre espace lecteur…
Chargement des commentaires…