DeepSeek V4 pousse l’IA open source vers le très long contexte
Un modèle ouvert qui lit jusqu’à un million de tokens change la taille des tâches que l’on peut confier à une IA.

DeepSeek remet la pression sur les grands modèles fermés avec V4, une nouvelle série open source lancée en version preview. La promesse est simple : traiter des volumes de texte beaucoup plus longs, avec des coûts d’inférence annoncés comme fortement réduits. La gamme comprend DeepSeek-V4-Pro, pensé pour les tâches exigeantes, et DeepSeek-V4-Flash, plus rapide et plus économique. Les deux modèles reposent sur une architecture Mixture of Experts : le modèle contient beaucoup de paramètres, mais n’en active qu’une partie à chaque requête. Le point le plus visible est la fenêtre de contexte native d’un million de tokens, utile pour analyser de longs documents, de gros historiques ou des bases de code entières. DeepSeek met aussi en avant une attention hybride CSA/HCA, conçue pour réduire le calcul et la mémoire nécessaires sur les très longs contextes. Sur V4-Pro, l’entreprise annonce 1,6 trillion de paramètres au total, dont 49 milliards actifs, et seulement 27 % des FLOPs ainsi que 10 % du cache KV par rapport à DeepSeek-V3.2 dans un scénario à un million de tokens. La vraie question n’est donc pas seulement la performance brute : c’est de savoir si les entreprises pourront enfin industrialiser des workflows IA longs, moins chers et plus contrôlables. La source officielle détaille les modèles, les modes d’usage et les chiffres d’architecture à examiner avant tout choix technique.
Pourquoi c’est important
Pour les équipes produit, data et IA, DeepSeek V4 peut rendre plus accessibles des cas d’usage jusque-là coûteux : analyse de très longs documents, agents avec mémoire étendue, revue de code massive ou recherche documentaire profonde. Mais les chiffres officiels doivent être confrontés à des tests internes, car le très long contexte peut coûter cher, ralentir les réponses et masquer des erreurs difficiles à repérer.
En bref
- •DeepSeek V4 arrive en version preview open source
- •Deux variantes sont proposées : Pro et Flash
- •Les deux modèles annoncent un contexte natif d’un million de tokens
- •V4-Pro active 49 milliards de paramètres sur 1,6 trillion
- •L’enjeu principal est le coût du très long contexte
Chiffres clés
À retenir
- •Surveiller V4-Pro pour les tâches longues et complexes
- •Tester V4-Flash pour les usages à haut débit
- •Vérifier les benchmarks indépendants avant une migration
- •Comparer le coût réel sur vos propres documents longs
Source de l’article
DeepSeek