DeepSeek V4.1 Flash est disponible depuis le 8 septembre 2026 en bêta interne, accessible directement via l’API de la société jusqu’au 10 septembre. Il s’agit de la mise à jour d’architecture la plus importante de la série V4 depuis son lancement en avril 2026, avec un support multimodal intégré nativement au modèle plutôt qu’ajouté après coup.
Une architecture repensée pour le multimodal
Contrairement à V4-Flash-Vision-Exp, publié le 21 août dernier, qui se contentait de greffer un module de vision sur le modèle texte existant, DeepSeek V4.1 Flash intègre directement le traitement du texte, de l’image et de la parole dans une architecture unifiée. DeepSeek présente cette version comme « plus capable, plus rapide et plus rentable » que la précédente génération V4 Flash.
Les premiers retours d’utilisateurs, relayés notamment sur Hacker News, font état de débits de l’ordre de 400 à 500 tokens par seconde, un niveau de vitesse jugé déterminant pour les applications de production où la latence pèse directement sur l’expérience utilisateur.
Comment tester la bêta
L’accès ne nécessite aucune inscription particulière au-delà d’un compte existant sur la plateforme DeepSeek. Il suffit de conserver l’URL de base de l’API habituelle et de remplacer le nom du modèle appelé par deepseek-v4.1-flash-expires-on-0910. Le nom du modèle indique lui-même sa date d’expiration : la bêta cessera de fonctionner le 10 septembre 2026.
- Tarification identique à celle de DeepSeek V4 Flash, sans surcoût pour la période de test
- Limite de 20 requêtes simultanées par compte
- Le modèle n’apparaît pas automatiquement dans la liste des modèles disponibles : il faut le renseigner manuellement
Une stratégie de diffusion informelle mais habituelle
Comme pour ses précédentes versions, DeepSeek n’a pas organisé de lancement officiel classique : la bêta a été repérée par la communauté de développeurs avant d’être confirmée par l’entreprise elle-même. Cette manière de procéder, déjà observée lors de la publication de V4-Flash-Vision-Exp, permet à DeepSeek de recueillir des retours techniques concrets avant une intégration définitive à l’offre commerciale.
Ce que cela change pour les développeurs
L’architecture unifiée est le point le plus regardé par les développeurs qui suivent la série V4 : jusqu’ici, ajouter la compréhension d’image ou de son à un modèle texte impliquait de brancher un module séparé, avec des pertes de cohérence entre les modalités. En intégrant nativement le texte, l’image et la parole dès l’entraînement, DeepSeek V4.1 Flash vise une meilleure cohérence des réponses lorsque plusieurs types de contenus sont mélangés dans une même requête, par exemple une image accompagnée d’une consigne écrite.
Le maintien de la tarification de DeepSeek V4 Flash pendant la période de bêta, malgré ces changements d’architecture, s’inscrit dans la stratégie de prix agressive de l’entreprise face à ses concurrents occidentaux et chinois sur le segment des modèles rapides et économiques.
Plus de détails techniques sont disponibles dans l’article de PANews.
Qu’est-ce que DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash est une bêta interne mise en ligne le 8 septembre 2026, dotée d’une architecture nativement multimodale traitant texte, image et parole dans un seul modèle, contrairement aux versions précédentes qui ajoutaient un module de vision séparé.
Comment accéder à la bêta de DeepSeek V4.1 Flash ?
Il suffit d’utiliser un compte API DeepSeek existant et de remplacer le nom du modèle par deepseek-v4.1-flash-expires-on-0910, avec la même URL de base et la même tarification que DeepSeek V4 Flash, dans la limite de 20 requêtes simultanées.
Quand la bêta de DeepSeek V4.1 Flash expire-t-elle ?
L’accès à cette bêta interne se termine le 10 septembre 2026, comme l’indique la date inscrite directement dans le nom du modèle utilisé pour les appels API.

