Plus d'un an après que son modèle de raisonnement R1 a secoué les marchés technologiques mondiaux, la startup chinoise d'IA DeepSeek a dévoilé un aperçu de son modèle V4 — le lancement de produit le plus significatif de l'entreprise depuis cette sortie virale. Le nouveau modèle est open-source et adapté pour fonctionner sur les processeurs AI Ascend de Huawei, un changement par rapport à la dépendance antérieure de l'entreprise aux puces Nvidia $NVDA.
Le V4 est disponible en deux versions : DeepSeek-V4-Pro, avec 1,6 trillion de paramètres totaux et 49 milliards de paramètres actifs, et DeepSeek-V4-Flash, avec 284 milliards de paramètres totaux et 13 milliards de paramètres actifs. Les deux prennent en charge une longueur de contexte d'un million de tokens. DeepSeek a déclaré que la version Pro surpasse d'autres modèles open-source dans les benchmarks de connaissance mondiale, ne venant qu'après le Gemini-3.1-Pro à source fermée de Google $GOOGL.
Selon Reuters, Huawei a déclaré avoir coordonné étroitement avec DeepSeek pour garantir la compatibilité de V4 à tous les niveaux de sa gamme de produits Ascend, et a confirmé séparément que son cluster informatique alimenté par Ascend est capable de faire fonctionner le nouveau modèle. Quelle partie de l'entraînement de V4 a reposé sur le matériel Huawei par rapport aux puces Nvidia $NVDA n'est pas connue, bien que Huawei ait reconnu que ses processeurs ont joué un rôle dans le processus.