Architecture DeepSeek V4 vérifiée : 3 prédictions sur 4 atteintes, module Engram absent

Message Gate News, 24 avril — DeepSeek a publié aujourd’hui la fiche du modèle V4, validant les prédictions d’architecture antérieures faites à partir de l’analyse de la bibliothèque de noyaux TileKernels publiée hier (23 avril). D’après le suivi par Beating, trois composants principaux ont été confirmés : mHC (Manifold-Constrained Hyper-Connections) remplaçant le HyperConnection original de ByteDance, une architecture MoE avec routage d’experts Top-k, et un stockage des poids en précision mixte FP4+FP8. Le module de mémoire conditionnelle Engram prédit n’apparaît pas dans la fiche du modèle.

La fiche du modèle a révélé de nouveaux composants non couverts par TileKernels : des mécanismes d’attention hybrides (CSA + HCA) qui font progresser l’efficacité du long contexte de V4, réduisant les FLOPs d’inférence à seulement 27 % du niveau de V3.2 pour des fenêtres de contexte de 1 M et une mémoire cache KV à 10 %. L’entraînement utilise désormais l’optimiseur Muon.

Cette vérification montre comment des implémentations de noyaux de niveau production peuvent révéler l’architecture sous-jacente du modèle avant que les spécifications officielles ne soient publiées.

Avertissement : Les informations contenues dans cette page peuvent provenir de tiers et ne représentent pas les points de vue ou les opinions de Gate. Le contenu de cette page est fourni à titre de référence uniquement et ne constitue pas un conseil financier, d'investissement ou juridique. Gate ne garantit pas l'exactitude ou l'exhaustivité des informations et n'est pas responsable des pertes résultant de l'utilisation de ces informations. Les investissements en actifs virtuels comportent des risques élevés et sont soumis à une forte volatilité des prix. Vous pouvez perdre la totalité du capital investi. Veuillez comprendre pleinement les risques pertinents et prendre des décisions prudentes en fonction de votre propre situation financière et de votre tolérance au risque. Pour plus de détails, veuillez consulter l'avertissement.

Articles similaires

V4‑Pro atteint un taux de réussite de 67 % en codage lors d’un test d’auto-utilisation interne, se rapprochant des performances d’Opus 4.5

Message d’actualités Gate, 24 avril — V4 a divulgué publiquement des données internes de tests d’auto-utilisation (dogfooding) pour son modèle V4‑Pro. La société a collecté environ 200 tâches d’ingénierie issues du monde réel auprès de plus de 50 ingénieurs, couvrant le développement de fonctionnalités, la correction de bogues, la refactorisation et le diagnostic sur des piles technologiques incluant

GateNewsIl y a 12m

Le Royaume-Uni examine Anthropic AI pour renforcer la cybersécurité bancaire

Le Royaume-Uni explore une étape majeure en matière de cybersécurité financière en travaillant avec la société d’IA Anthropic. Des discussions préliminaires laissent entendre que le gouvernement pourrait déployer le modèle avancé Claude Mythos d’Anthropic dans les banques et les institutions financières. Cette démarche vise à renforcer les défenses face aux menaces cybernétiques

CryptometerIoIl y a 17m

Le bureau chinois de la PI ajoute l’IA, les semi-conducteurs et les interfaces cerveau-ordinateur à son programme de protection accélérée

Message de Gate News, 24 avril — L’Administration nationale chinoise de la propriété intellectuelle a annoncé le 24 avril qu’elle mettra en place une protection complète de la propriété intellectuelle pour les technologies émergentes grâce à des réformes institutionnelles, des services renforcés et des applications étendues. L’administration wi

GateNewsIl y a 24m

Le gouvernement américain exploite un nœud Bitcoin sans minage, indique l’amiral

Un amiral senior a indiqué que le gouvernement américain exploite activement un nœud sur le réseau Bitcoin tout en évitant délibérément de participer aux activités de minage. La divulgation suggère que les autorités prennent un rôle plus impliqué dans l’infrastructure blockchain pour la supervision et

CryptoFrontierIl y a 40m

Le chiffre d’affaires du T1 de Tesla progresse de 16% à 22,4 Md$ ; lancement du robot humanoïde prévu à la mi-2026

Message de Gate News, 24 avril — Tesla a publié un chiffre d’affaires du premier trimestre de 22,4 milliards $ US le 23 avril, soit une hausse de 16% d’une année sur l’autre. Les livraisons mondiales de véhicules de l’entreprise ont dépassé 358 000 unités, tandis que la production a dépassé 408 000 unités. La gigafactory de Shanghai de Tesla a livré 213 000 véhi

GateNewsIl y a 40m

Le bénéfice de SK Hynix au T1 explose par cinq et atteint un record grâce au boom de l’IA, avec des primes aux employés portées à 878 000 $

Message de Gate News, 24 avril — SK Hynix a annoncé une hausse par cinq de son bénéfice opérationnel trimestriel, à un niveau record de 37,61 billions de wons ($32,4 milliards) le 23 avril, portée par une demande en forte hausse liée à l’intelligence artificielle et aux centres de données. La manne alimente des primes aux employés sans précédent, que les analystes estiment susceptibles d’atteindre jusqu’à 878 000 $ par employé en 2027 si les prévisions actuelles de bénéfices se maintiennent. Les primes

GateNewsIl y a 1h
Commentaire
0/400
Aucun commentaire