Jalapeño d’OpenAI devance Nvidia tout en consommant moins
3 min · 27 août 2026

Jalapeño d’OpenAI devance Nvidia tout en consommant moins

Par Arthur Dekeyser

En résumé

1

OpenAI a conçu Jalapeño avec Broadcom pour exécuter des modèles d’IA.

2

Les tests internes annoncent jusqu’à 3,6 fois plus de vitesse et 1,9 fois plus de travail par watt.

3

OpenAI prévoit deux générations supplémentaires et une montée en production jusqu’en 2027.

💡

Le signal : OpenAI affirme que Jalapeño répond jusqu’à 3,6 fois plus vite que les systèmes Nvidia testés.

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

OpenAI passe au silicium. Le groupe a publié le 26 août 2026 les premiers résultats de Jalapeño, sa puce conçue avec Broadcom pour exécuter des modèles d’intelligence artificielle. Les tests internes d’OpenAI la comparent aux systèmes phares de Nvidia. La puce consomme 700 watts, contre 1 200 watts pour les solutions Nvidia évaluées. OpenAI affirme que Jalapeño répond jusqu’à 3,6 fois plus vite. Elle fournirait aussi jusqu’à 1,9 fois plus de travail par watt. L’entreprise ne prévoit pas de vendre ce composant. Le vice-président chargé du matériel, Richard Ho, explique qu’OpenAI en a un besoin interne important. Lire les résultats publiés.

Une conception accélérée. OpenAI affirme avoir utilisé son futur modèle Astra et Codex pour créer Jalapeño. Le processus aurait duré neuf mois, de la première conception à une version prête pour la fabrication. La puce vise l’exécution des modèles, et non leur entraînement. OpenAI continue donc de s’appuyer sur Nvidia pour entraîner ses nouveaux modèles. Deux générations supplémentaires de Jalapeño sont déjà en préparation. L’entreprise prévoit une arrivée dans ses centres de données plus tard en 2026. La production doit ensuite monter en puissance pendant 2027. Ces étapes décrivent un déploiement interne progressif, sans annonce de commercialisation auprès d’autres entreprises.

OpenAI prépare deux générations supplémentaires

Le calendrier se précise. OpenAI prévoit d’intégrer Jalapeño dans ses centres de données plus tard cette année. La production doit augmenter jusqu’en 2027, tandis que deux nouvelles générations sont déjà en développement. Les résultats communiqués restent issus de tests internes de l’entreprise. Ils portent sur la vitesse de réponse et le travail réalisé par watt. Le matériel affiche une puissance nominale de 700 watts. Les systèmes Nvidia comparés atteignent 1 200 watts. OpenAI distingue ainsi deux usages dans son infrastructure. Jalapeño doit exécuter les modèles. Nvidia conserve un rôle dans l’entraînement des nouveaux modèles d’OpenAI. Cette coexistence structure la prochaine phase du déploiement matériel.

Les laboratoires conçoivent aussi. Google dispose de TPU développées en interne, tandis qu’Anthropic, Amazon et Microsoft prévoient également leurs propres architectures. Le bulletin estime que Jalapeño pourrait offrir à OpenAI des jetons moins coûteux et plus rapides si ses chiffres se confirment. Il associe aussi cette stratégie à une conception adaptée à chaque modèle. Cette conclusion reste conditionnelle aux résultats annoncés par OpenAI. Le choix de conserver Jalapeño pour les besoins internes confirme toutefois l’objectif opérationnel présenté par Richard Ho. OpenAI ne l’inscrit pas dans une offre de puces vendue au marché. L’entreprise maintient parallèlement Nvidia pour l’entraînement de ses futurs modèles.

Les benchmarks restent internes

Les prochaines étapes sont datées. OpenAI vise une installation de Jalapeño dans ses centres de données plus tard en 2026. La montée en production est prévue pendant 2027. Deux générations supplémentaires sont déjà en préparation. Le groupe a associé la puce à Broadcom et indique avoir utilisé Astra ainsi que Codex lors de sa conception. Jalapeño reste destiné à l’exécution des modèles, alors que Nvidia demeure utilisé pour leur entraînement. Les benchmarks publiés comparent une puce de 700 watts à des systèmes Nvidia de 1 200 watts. OpenAI revendique jusqu’à 3,6 fois plus de rapidité et 1,9 fois plus de travail par watt.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi