DeepSeek a fait passer son modèle phare en disponibilité générale : DeepSeek V4 Pro quitte la préversion sous la référence DeepSeek-V4-Pro-0813, accessible dès maintenant via l’API officielle. Le laboratoire chinois maintient un tarif nettement inférieur à celui des modèles occidentaux comparables, tout en prévenant que cette grille de prix ne durera pas.

Un identifiant d’API inchangé, un modèle mis à jour

Selon la documentation officielle de DeepSeek, l’identifiant d’appel deepseek-v4-pro pointe désormais directement vers cette nouvelle version 0813, sans changement nécessaire côté intégration pour les développeurs qui utilisaient déjà le modèle. Les deux formats d’API restent proposés : le format compatible OpenAI (api.deepseek.com) et un format compatible Anthropic (api.deepseek.com/anthropic), pratique pour les équipes qui veulent tester le modèle sans réécrire leur code.

Le modèle prend en charge un mode de raisonnement (« thinking ») activé par défaut, un mode direct sans raisonnement, l’appel d’outils (tool calls) et la sortie structurée au format JSON.

Une fenêtre de contexte d’un million de tokens

DeepSeek V4 Pro annonce une fenêtre de contexte d’un million de tokens, avec une sortie maximale de 384 000 tokens en une seule réponse. La limite de concurrence est fixée à 500 requêtes simultanées côté API officielle. Ces chiffres placent le modèle parmi les plus généreux du marché en matière de contexte exploitable, un critère de plus en plus déterminant pour les usages agentiques qui manipulent de longs documents ou de larges bases de code.

Un tarif agressif, mais provisoire

Sur la tarification officielle, DeepSeek V4 Pro facture 0,87 $ par million de tokens en sortie, 0,435 $ par million de tokens en entrée en cas de défaut de cache, et seulement 0,003625 $ par million de tokens en entrée lorsque le cache est utilisé. Cette tarification reste très inférieure à celle des modèles frontière occidentaux les plus récents.

DeepSeek prévient toutefois explicitement, sur sa propre page de tarification, qu’une hausse générale des prix de l’API est prévue « dans un futur proche », sans donner de date précise ni de nouveau barème. L’entreprise ne précise pas non plus si cette hausse concernera uniquement les nouveaux modèles ou l’ensemble du catalogue.

Une taille de modèle qui pèse dans la course chinoise à l’échelle

Selon une analyse de The Decoder publiée le même jour à propos du prochain modèle Nemotron 4 de Nvidia, DeepSeek V4 Pro totaliserait environ 1 600 milliards de paramètres, un chiffre qui illustre l’écart de taille pris par les laboratoires chinois face aux modèles ouverts occidentaux. Moonshot AI et son Kimi K3 revendiquent de leur côté 2 800 milliards de paramètres. Cette course au paramètre ne dit rien à elle seule de la qualité d’un modèle, mais elle traduit l’ampleur des moyens de calcul désormais engagés par ces laboratoires.

La sortie de préversion de V4 Pro s’inscrit dans un rythme de publication soutenu pour DeepSeek, qui avait déjà mis à jour son modèle V4 Flash quelques jours plus tôt. Plus de détails techniques sont disponibles dans la documentation officielle de l’API DeepSeek. Nvidia, de son côté, prépare une réponse avec Nemotron 4, qui vise 1 000 milliards de paramètres sans toutefois atteindre le niveau de DeepSeek V4 Pro sur ce critère.

DeepSeek V4 Pro est-il disponible dès maintenant ?

Oui, le modèle DeepSeek-V4-Pro-0813 est accessible en disponibilité générale via l’API officielle depuis le 13 août 2026, sous le même identifiant deepseek-v4-pro utilisé pour les versions précédentes.

Quel est le prix de DeepSeek V4 Pro ?

DeepSeek V4 Pro facture 0,87 $ par million de tokens en sortie et 0,435 $ par million de tokens en entrée sans cache, contre seulement 0,003625 $ avec cache. DeepSeek annonce toutefois une hausse de prix à venir sur l’ensemble de son API.

Quelle est la taille du contexte de DeepSeek V4 Pro ?

Le modèle propose une fenêtre de contexte d’un million de tokens, avec une sortie maximale de 384 000 tokens par réponse, et une limite de 500 requêtes simultanées sur l’API officielle.

Share.
Exit mobile version