# OpenAI révolutionne la vitesse avec GPT-5.6 Sol Ultrafast

> OpenAI lance Ultrafast dans son API, un mode qui fait répondre GPT-5.6 Sol jusqu’à 14 fois plus vite grâce aux puces de Cerebras.

Type : Actualité IA · Catégorie : Outils · Publié le 2026-08-14 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/openai-accelere-gpt-56-sol-jusqua-14-fois
Tags : openai, cerebras, gpt-5.6 sol, api, intelligence artificielle, chatgpt, raisonnement, inference

---

## En résumé

- Ultrafast peut générer jusqu’à 750 unités de texte par seconde avec GPT-5.6 Sol, sans changer le modèle.
- L’accès commence dans l’API pour quelques clients, dont Jane Street, la relation client et la comptabilité.
- OpenAI n’a annoncé aucun prix, tandis que les offres rapides actuelles sont déjà facturées davantage que le traitement standard.

**Le signal :** Avec Cerebras, GPT-5.6 Sol pourrait produire jusqu’à 750 unités de texte par seconde dans l’API OpenAI.

## OpenAI accélère le modèle GPT-5.6 Sol

OpenAI a ouvert le 13 août un aperçu limité d’Ultrafast, un nouveau palier de son interface de programmation. Le principe ne repose pas sur un modèle différent : GPT-5.6 Sol conserve la même intelligence, mais peut produire du texte jusqu’à 14 fois plus vite que dans le traitement standard, avec un débit annoncé pouvant atteindre 750 unités de texte par seconde. Le facteur 14 reste toutefois une mesure mise en avant par OpenAI, sans vérification externe publiée à ce jour.

Cette accélération vient du matériel fourni par Cerebras. Le fabricant américain grave ses processeurs sur une galette de silicium entière, plutôt que de découper celle-ci en puces individuelles. Son système permet ainsi de faire tenir un modèle complet sur un seul composant, au lieu de le répartir sur des armoires de cartes graphiques qui doivent échanger des données. Selon la présentation fournie, la réduction de ces échanges diminue la latence sans modifier la qualité du raisonnement. Le composant utilisé, le Cerebras WSE-3, compte 44 milliards de transistors.

## Ultrafast cible les usages en temps réel

OpenAI illustre le gain avec un simulateur d’entrepôt logistique en trois dimensions, généré à partir d’une seule consigne. L’exercice est exécuté en parallèle dans les deux modes afin de rendre l’écart visible. Pour une application complète, le modèle écrit du code en continu : chaque unité de texte produite plus rapidement réduit directement le temps d’attente.

Ultrafast est pour l’instant réservé à quelques clients de l’API, celle que les développeurs connectent à leurs propres outils. OpenAI prévoit d’élargir l’accès à mesure que ses capacités augmentent. Parmi les premiers testeurs figurent Jane Street, des entreprises de la relation client et des acteurs de la comptabilité. Les métiers visés comprennent notamment la réponse aux incidents informatiques, le débogage, la recherche financière, la détection de fraude, le support client en temps réel, les applications vocales et le commerce en ligne.

Les utilisateurs de ChatGPT et de Codex ne sont donc pas concernés à ce stade. OpenAI décrit aussi un usage interne : pendant un incident technique, ses développeurs peuvent faire analyser en direct les journaux d’activité, les traces et les échanges internes, puis préparer et valider des correctifs, la décision finale restant humaine. Dans la recherche, des expérimentations qui nécessitaient auparavant une nuit pourraient permettre plusieurs itérations au cours d’une même journée. Un testeur estime que cette vitesse « change complètement l’expérience d’appel pour le travail complexe ».

## Le prix reste encore inconnu

OpenAI n’a annoncé aucun tarif pour Ultrafast. Sa grille actuelle suggère néanmoins que la vitesse est déjà commercialisée comme une option premium : le mode rapide, rebaptisé fin juillet, atteint jusqu’à 2,5 fois la cadence standard et coûte davantage que le tarif normal. À l’inverse, les traitements différés ou à latence variable sont facturés moitié moins cher. Ultrafast allant près de six fois plus vite que ce mode rapide, son prix pourrait s’inscrire dans cette logique, sans qu’OpenAI l’ait confirmé.

Pour Cerebras, ce partenariat intervient alors que le fabricant, entré en Bourse cette année, cherche à démontrer l’intérêt de ses puces géantes au-delà des présentations techniques. Pour OpenAI, cette solution offre aussi une alternative à sa dépendance à Nvidia. Le changement ne se verra pas immédiatement dans ChatGPT, mais pourrait apparaître plus tard dans des assistants vocaux avec moins de silences et des services clients répondant au rythme d’une conversation.
