# Vera Rubin délivre sept fois plus de tokens par mégawatt

> Les tests de Vera Rubin NVL72 affichent jusqu’à 7 fois plus de tokens par mégawatt que Blackwell sur un modèle DeepSeek de 1,6 T.

Type : Actualité IA · Catégorie : Tendances · Publié le 2026-09-15 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/vera-rubin-atteint-7-fois-le-debit-de-blackwell-par-megawatt
Tags : nvidia, inférence, modèles géants, efficacité énergétique, deepseek, inference

---

## En résumé

- Vera Rubin NVL72 atteint jusqu’à sept fois le débit de tokens par mégawatt de Blackwell.
- Les tests ont utilisé un modèle DeepSeek de 1,6 trillion de paramètres.
- Le résultat dépasse l’estimation de trois fois attribuée à Jensen Huang pour les modèles de 1 à 3 trillions.

**Le signal :** Vera Rubin NVL72 atteint jusqu’à 7 fois le débit de tokens par mégawatt de Blackwell sur un modèle DeepSeek de 1,6 T.

**Vera Rubin NVL72** affiche jusqu’à sept fois plus de débit de tokens par mégawatt que Blackwell. Les tests portent sur un modèle DeepSeek de 1,6 trillion. Cette mesure compare directement le débit d’inférence et la consommation électrique. Le résultat concerne donc l’[efficacité énergétique](/signal-ia/actu/nvidia-annonce-jusqua-30-fois-plus-de-debit-par-megawatt) du traitement d’un modèle très volumineux. La comparaison est formulée entre Vera Rubin NVL72 et Blackwell. Elle ne porte pas sur la qualité des réponses générées. Elle ne mesure pas non plus le coût total d’un système. Le résultat publié fournit un indicateur précis pour les charges d’inférence. La performance maximale annoncée atteint sept fois le niveau observé avec Blackwell. [Voir le signalement](https://www.techmeme.com/260914/p41#a260914p41).

**Le modèle DeepSeek** utilisé pour les essais compte 1,6 trillion de paramètres. Ce volume le place dans la plage des modèles de 1 à 3 trillions évoquée par Jensen Huang. Les tests ne concernent donc pas un modèle de taille plus réduite. Ils évaluent Vera Rubin NVL72 sur une charge d’[inférence](/signal-ia/actu/apr-de-pan-lia-redefinit-le-raisonnement-parallele) associée à un modèle DeepSeek précis. Le chiffre de sept fois reste présenté comme un maximum. Il décrit le débit de tokens obtenu par mégawatt. Blackwell sert de référence dans cette comparaison. Les éléments chiffrés relient ainsi une architecture, un modèle et une mesure énergétique déterminée.

## Vera Rubin dépasse Blackwell

**Jensen Huang avait avancé** un gain de trois fois pour les modèles de langage comptant entre 1 et 3 trillions de paramètres. Les essais de Vera Rubin NVL72 affichent jusqu’à sept fois le débit de tokens par mégawatt de Blackwell. Le résultat dépasse donc cette estimation de trois fois. La comparaison associe l’affirmation de Huang à une plage de modèles comprise entre 1 et 3 trillions. Le test décrit ici porte précisément sur un modèle [DeepSeek](/signal-ia/actu/baseten-bouscule-hugging-face-avec-kimi-k3) de 1,6 trillion. Les deux chiffres utilisent le débit de tokens par mégawatt comme référence. Le chiffre de sept fois correspond au résultat maximal rapporté pour Vera Rubin NVL72.

**La mesure énergétique** constitue le point commun entre les deux chiffres. Les essais de Vera Rubin NVL72 rapportent jusqu’à sept fois plus de tokens par mégawatt que Blackwell. L’estimation attribuée à Jensen Huang évoque trois fois pour les modèles de 1 à 3 trillions. Le modèle DeepSeek testé atteint 1,6 trillion de paramètres. Cette valeur se situe dans la plage citée par Huang. Le rapprochement porte donc sur une même famille de modèles et une même unité de comparaison. Les résultats restent exprimés comme des performances de débit d’inférence par mégawatt. [Consulter la référence publiée](https://www.techmeme.com/260914/p41#a260914p41).

## Un écart mesuré à sept fois

**Le résultat maximal atteint** sept fois le débit de tokens par mégawatt de Blackwell. Cette valeur provient de tests réalisés sur Vera Rubin NVL72. Le modèle utilisé est DeepSeek, avec 1,6 trillion de paramètres. Elle dépasse le gain de trois fois attribué à Jensen Huang pour les modèles de 1 à 3 trillions. Les chiffres décrivent une comparaison de performance énergétique entre deux plateformes. Ils ne donnent pas une mesure générale de tous les usages de Vera Rubin. Ils établissent toutefois un écart chiffré dans le scénario d’inférence testé. La donnée principale reste donc le rapport maximal de sept fois observé face à Blackwell.
