# OpenAI booste GPT-5.6 Sol avec le mode Ultrafast

> OpenAI prévisualise Ultrafast, un mode Cerebras pour GPT-5.6 Sol capable d’atteindre 750 tokens par seconde, d’abord réservé à quelques clients API.

Type : Actualité IA · Catégorie : Stratégie · Publié le 2026-08-14 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/openai-accelere-gpt-56-sol-avec-le-mode-ultrafast
Tags : openai, cerebras, gpt-5.6 sol, inférence ia, ultrafast, chatgpt, raisonnement, inference

---

## En résumé

- Ultrafast peut produire jusqu’à 750 tokens par seconde avec GPT-5.6 Sol grâce à l’inférence de Cerebras.
- Le mode est d’abord limité à l’API et à certains clients, avant une ouverture progressive selon les capacités disponibles.
- OpenAI ajoute une offre plus rapide et probablement plus chère à son système de tarification de l’inférence, après Fast Mode à 2,5 fois la vitesse.

**Le signal :** Avec Cerebras, OpenAI annonce jusqu’à 750 tokens par seconde pour GPT-5.6 Sol.

## OpenAI lance Ultrafast pour GPT-5.6

OpenAI lance en préversion le mode « Ultrafast » pour GPT-5.6 Sol, son modèle phare de raisonnement. Cette version peut produire jusqu’à 750 tokens par seconde. L’inférence repose sur Cerebras, qui a signé plus tôt cette année un partenariat de 10 milliards de dollars avec OpenAI.

Le service est d’abord accessible uniquement via l’API OpenAI, pour GPT-5.6 Sol, et à un nombre limité de clients sélectionnés. OpenAI prévoit d’élargir progressivement l’accès à mesure que ses capacités augmentent. Les entreprises intéressées peuvent s’inscrire à une liste d’information au moyen d’un formulaire. OpenAI indique déjà utiliser ce modèle en interne pour l’analyse d’incidents.

## La vitesse ouvre de nouveaux usages

OpenAI présente Ultrafast comme une combinaison entre la rapidité des petits modèles et les capacités complètes d’un grand modèle de raisonnement. L’entreprise parle de « travail utile par seconde » supplémentaire. Lors d’une panne, des ingénieurs pourraient faire analyser les journaux, les modifications de code et les rapports pendant que l’incident se déroule, afin d’identifier la cause et de préparer un correctif en temps réel.

Les scénarios avancés par OpenAI couvrent aussi la finance, où le modèle pourrait évaluer des signaux de marché et repérer des transactions suspectes pendant que les conditions évoluent. Dans le support client, il pourrait traiter en temps réel des demandes complexes nécessitant plusieurs étapes ou systèmes. Dans l’e-commerce, il pourrait répondre aux questions sur les produits, vérifier les niveaux de stock et personnaliser les recommandations avant qu’un acheteur hésitant n’abandonne son panier.

La recherche figure également parmi les usages mis en avant. Des expériences auparavant exécutées pendant la nuit sous forme de traitements par lots pourraient devenir des sessions interactives: les équipes testeraient une idée, examineraient les résultats, ajusteraient leur approche puis lanceraient une nouvelle exécution sans interrompre leur flux de travail. OpenAI illustre cette capacité avec la génération d’un simulateur d’entrepôt en 3D, présentée en mode Ultrafast.

## OpenAI transforme la vitesse en option payante

L’API OpenAI commercialise déjà la rapidité par niveaux. Le « Fast Mode » promet jusqu’à 2,5 fois plus de vitesse et une latence réduite pour GPT-5.6 Sol, pour un prix approximativement deux fois supérieur. Ultrafast ajoute un troisième niveau, plus rapide et probablement plus coûteux. Cette logique rappelle celle de fournisseurs cloud comme AWS, qui facturent depuis longtemps davantage les mêmes services lorsqu’ils offrent de meilleures performances. OpenAI applique ainsi cette approche à l’inférence, avec l’objectif de capter une part des gains de revenus que la rapidité pourrait générer pour les entreprises.
