DeepSeek a officiellement lancé DeepSeek V4.1 Flash. Cette version fait passer la gamme Flash à une nouvelle architecture et intègre nativement la compréhension visuelle dans l’API principale, au lieu de la maintenir dans une branche expérimentale séparée. DeepSeek présente V4.1 Flash comme le plus petit modèle d’une nouvelle famille d’architectures conçue pour augmenter les capacités tout en améliorant la vitesse d’inférence et le débit. Reuters a confirmé indépendamment le lancement du 10 septembre.

Pour les développeurs, l’enjeu dépasse largement les scores de benchmark. DeepSeek modifie en même temps la manière dont ses modèles sont adressés dans l’API : V4.1 Flash est accessible via deepseek-flash, les anciens identifiants V4 Flash et V4 Flash Vision Exp sont temporairement redirigés vers le nouveau modèle, et l’entreprise prévoit de rediriger également les requêtes V4 Pro vers V4.1 Flash à partir du 14 septembre, jusqu’à la sortie de V4.1 Pro. Il s’agit donc d’une migration de version, pas seulement d’un nouveau modèle à tester.

Une nouvelle architecture plutôt qu’un simple rafraîchissement

DeepSeek affirme que V4.1 Flash appartient à une nouvelle famille d’architectures et ne constitue pas seulement une étape supplémentaire de post-entraînement de V4 Flash. La compréhension visuelle multimodale est désormais native, tandis que les poids du modèle et un rapport technique ont été publiés en parallèle.

La différence avec V4 Flash Vision Exp est importante. Cette précédente variante était explicitement expérimentale et pouvait être traitée comme une branche spécifique aux usages visuels. V4.1 Flash réunit désormais ces capacités dans le modèle que DeepSeek positionne comme l’interface Flash principale.

L’entreprise publie également une longue série de résultats sur des évaluations de raisonnement, de programmation, d’utilisation du terminal, de sécurité et de tâches agentiques. Ces chiffres restent des résultats communiqués par le fournisseur et ne constituent pas, à eux seuls, une démonstration indépendante de supériorité générale. Le changement de produit, lui, est établi : le modèle est lancé, ses poids sont disponibles et les règles de routage de l’API évoluent.

Le changement d’API est probablement le point le plus important

DeepSeek indique que deepseek-flash permet désormais d’appeler V4.1 Flash. Pour préserver la compatibilité, les requêtes envoyées à deepseek-v4-flash ou deepseek-v4-flash-vision-exp sont temporairement acheminées vers V4.1 Flash.

Cette approche facilite la migration, mais elle crée un problème de traçabilité : un identifiant historique ne décrit plus nécessairement le modèle qui a réellement traité la requête. Les équipes qui dépendent d’évaluations reproductibles, de tests de non-régression ou d’un historique d’audit ne devraient donc pas considérer qu’un nom de modèle inchangé garantit un comportement inchangé.

Le cas de V4 Pro rend ce risque encore plus concret. DeepSeek prévoit qu’à partir de midi, heure de Pékin, le 14 septembre, les appels à deepseek-v4-pro seront servis par V4.1 Flash jusqu’au lancement de V4.1 Pro, avec la tarification de V4.1 Flash. Pour une application qui utilise « Pro » comme niveau de qualité ou comme référence d’évaluation, le sens de la configuration change même si l’appel API continue de fonctionner.

La compatibilité ne doit pas masquer un changement de modèle

Les alias de compatibilité sont utiles pour éviter des interruptions de service, mais ils peuvent brouiller la provenance lorsqu’un fournisseur remplace le modèle derrière un identifiant sans demander de modification côté client.

L’analyse d’Aipolix est qu’une équipe en production devrait enregistrer séparément le nom demandé par l’application et, lorsque le fournisseur le permet, la version effectivement servie. Si cette dernière n’est pas exposée avec suffisamment de précision, il devient important d’horodater les campagnes d’évaluation et de conserver les informations de routage annoncées par le fournisseur.

Cette discipline est particulièrement utile pour les agents et les outils de développement. Un changement de modèle peut modifier le choix des outils, la latence, la consommation de jetons, le traitement des images et les modes d’échec, alors même que l’application n’a pas changé. Une redirection de compatibilité mérite donc le même suivi qu’une mise à niveau explicite.

Les promesses de performance doivent être testées séparément

DeepSeek affirme que V4.1 Flash coûte moins cher et qu’il dépasse V4 Pro dans ses tests sur la performance, le coût, la vitesse et le temps total d’exécution. Ces affirmations peuvent guider les priorités de test, mais elles ne remplacent pas une évaluation sur les charges de travail réelles.

Pour les utilisateurs actuels de l’API DeepSeek, la démarche la plus utile consiste à rejouer un ensemble représentatif de requêtes et de trajectoires agentiques, à comparer la qualité des réponses et l’usage des outils, puis à mesurer la latence et la consommation de jetons avant l’entrée en vigueur du routage de V4 Pro.

Les poids ouverts facilitent la vérification

DeepSeek a publié les poids de V4.1 Flash sur Hugging Face ainsi qu’un rapport technique. Les chercheurs et les équipes d’infrastructure disposant des ressources nécessaires peuvent donc étudier le modèle en dehors de l’API hébergée.

Cela ne garantit pas qu’un déploiement autonome reproduira exactement le service de DeepSeek. Le moteur d’inférence, la quantification, les paramètres d’exécution et les couches de service peuvent modifier le comportement observé. L’accès aux poids permet néanmoins de mieux séparer les propriétés du modèle des particularités de l’environnement hébergé.

La conséquence pratique est claire : V4.1 Flash n’est pas seulement une version plus rapide de Flash. Il introduit une nouvelle architecture, généralise le multimodal, modifie le routage de compatibilité et change temporairement ce que signifie une requête envoyée à V4 Pro. Les équipes utilisant DeepSeek devraient traiter ce déploiement comme une migration de version et adapter leurs contrôles d’évaluation et de traçabilité.

Sources
- https://x.com/deepseek_ai/status/2097930627949711516
- https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
- https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf
- https://www.reuters.com/world/asia-pacific/chinas-deepseek-launches-v41-flash-model-2026-09-10/