DeepSeek V4 publié fin avril, confirmé en interne par Liang Wenfeng : une fenêtre de 1 million de tokens, entièrement exécutée sur la puce Huawei Ascend 950 PR

Le fondateur de DeepSeek, Liang Wenfeng, a confirmé de ses propres mots en interne que le nouveau modèle phare de la génération V4 sera officiellement lancé à la fin du mois d’avril. D’après des fuites de spécifications, le nombre total de paramètres frôle 1 000 milliards, avec un contexte de support d’environ 1 million de tokens, et l’exécution serait entièrement assurée sur les puces Ascend de Huawei ; cela est considéré comme une étape clé de la percée en IA en Chine, moins dépendante de Nvidia.
(Contexte : DeepSeek V4 refuse Nvidia, choisit Huawei ! Alibaba, ByteDance, Tencent se ruent pour acheter des puces Ascend 950PR)
(Complément de contexte : DeepSeek a lancé le « mode expert » et le « mode visuel » ; V4 se prépare-t-il ainsi avant sa sortie officielle ?)

D’après les informations rapportées par le « Sina Finance », citées par des personnes informées, Liang Wenfeng, le fondateur de DeepSeek, aurait révélé que le nouveau modèle phare de génération DeepSeek V4 sera présenté officiellement à la fin du mois d’avril. L’officialité n’a pas encore publié de date exacte, mais la communauté développeur ressent déjà des signaux de chauffe : la variante V4-Lite est actuellement testée sur des nœuds d’API, avec une vitesse d’inférence supérieure de 30 % par rapport à la génération précédente ; le taux de rappel de contexte de 128K tokens atteint 94 %.

Des centaines de milliards de paramètres, une fenêtre de un million de tokens

Selon les informations non confirmées mais divulguées à ce jour, l’architecture V4 reprend la conception Mixture-of-Experts (MoE). Le nombre total de paramètres serait d’environ 1 000 milliards, mais les paramètres réellement activés par token ne seraient que d’environ 37 milliards, conservant ainsi l’approche « de comptable des calculs » propre à DeepSeek en termes d’efficacité de calcul.

Partie fenêtre de contexte : V4, grâce à un tout nouveau module Engram, pourrait prendre en charge un contexte ultra-long de 1 million de tokens, pour rivaliser avec les modèles de tout premier plan actuels. Le concept central d’Engram est la requête de mémoire conditionnelle, permettant au modèle d’accéder aux connaissances avec une complexité de O(1), plutôt que de gonfler linéairement avec la longueur de la séquence.

Sur le plan des capacités, des tests de référence divulgués indiquent HumanEval à 90 % et SWE-bench Verified à plus de 80 % ; si les données sont exactes, cela rattraperait aussi de près les modèles phares dominants actuels. Côté modalités, V4 prendrait nativement en charge l’entrée de texte, d’images et de vidéos ; le prix serait d’environ $0.30/MTok (entrée), prolongeant la stratégie de prix bas de DeepSeek.

Entièrement exécuté sur les puces de Huawei : le signal géopolitique le plus important

Au-delà des spécifications techniques, le point qui attire le plus l’attention du public concernant V4 est un changement radical de stratégie matérielle : l’officialité affirme que l’ensemble du modèle sera exécuté entièrement sur les puces Ascend 950 PR de Huawei, sans dépendre de GPU Nvidia.

Cette décision a des répercussions bien plus larges que DeepSeek lui-même. Alibaba, ByteDance et Tencent ont déjà commencé à acheter en grandes quantités des puces de prochaine génération de Huawei. Si V4 réussit à valider que l’Ascend peut prendre en charge les besoins d’entraînement et d’inférence des modèles phares de haut niveau, ce serait, jusqu’à présent, l’exemple d’application le plus convaincant de l’autonomisation de la chaîne industrielle de l’IA en Chine au niveau des puces.

Dans ce contexte, les mesures de restriction des exportations de Nvidia vers les États-Unis pourraient au contraire devenir un catalyseur pour accélérer la maturation de l’écosystème autonome chinois.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire