DeepSeek V4 : 1,6 trillion de paramètres, prix cassés et puces Huawei pour bousculer OpenAI
Tous les articles du blog
Un an après le séisme R1, DeepSeek revient sur le devant de la scène. Le laboratoire chinois a lancé le 24 avril la preview open source de DeepSeek-V4, et les chiffres donnent le vertige.
DeepSeek V4 Pro et Flash : deux modèles, un million de tokens
V4-Pro affiche 1,6 trillion de paramètres totaux (49 milliards actifs), tandis que V4-Flash se veut plus léger avec 284 milliards (13 milliards actifs). Les deux supportent nativement une fenêtre de contexte d'un million de tokens, un bond considérable par rapport aux 128 000 tokens de V3.
L'architecture repose sur un mécanisme d'attention hybride combinant Compressed Sparse Attention (CSA) et Heavily Compressed Attention (HCA). Résultat concret : V4-Pro ne consomme que 27 % des FLOPs et 10 % du cache KV par rapport à V3.2 en contexte d'un million de tokens.
Des performances proches des modèles fermés, à une fraction du prix
V4-Flash coûte 0,14 $ par million de tokens en entrée et 0,28 $ en sortie, ce qui casse littéralement les tarifs de GPT-5.4, Gemini 3.1 Flash et Claude Haiku. DeepSeek admet toutefois un retard de « trois à six mois » sur les meilleurs modèles fermés, avec GPT-5.4 et Gemini 3.1 Pro encore légèrement devant en connaissances générales.
Le laboratoire revendique le titre de meilleur modèle open source pour les maths et le coding. Sur LiveCodeBench, V4-Pro-Max obtient 93,5, un nouveau record pour un modèle à poids ouverts. La concurrence, y compris le tout récent GPT-5.5 « Spud » d'OpenAI, a du souci à se faire côté rapport qualité-prix.
Puces Huawei et souveraineté numérique chinoise
Huawei a confirmé vendredi que ses processeurs Ascend peuvent supporter le modèle V4. C'est un signal fort : selon l'analyste Wei Sun de Counterpoint, la capacité de V4 à tourner sur du silicium local pourrait aider Pékin à réduire sa dépendance envers Nvidia. Le doute persiste néanmoins sur les puces réellement utilisées pour l'entraînement.
Les actions des fonderies chinoises SMIC et Hua Hong Semiconductor ont bondi de 9 % et 15 % à Hong Kong. L'écart de plus en plus mince entre DeepSeek et les leaders américains pose des questions sur la solidité du fossé concurrentiel d'OpenAI et d'Anthropic.
Ce que DeepSeek V4 change pour les développeurs
V4 est optimisé pour les outils agents populaires tels que Claude Code d'Anthropic et OpenClaw. Le modèle supporte les API au format OpenAI ChatCompletions et Anthropic, ce qui facilite l'intégration. Pour les équipes qui cherchent des performances frontier sans le prix frontier, V4 mérite clairement un essai sérieux.