Par Arthur Dekeyser
En résumé
OpenAI annonce Ultrafast pour GPT-5.6 Sol, avec une vitesse pouvant atteindre 750 tokens par seconde.
Le niveau est actuellement accessible sur invitation et son prix n’a pas encore été communiqué.
Sol a terminé un test de 2500 questions en 11 heures avec Ultrafast, contre 78 heures pour Fable, avec des résultats comparables.
Le signal : Avec Ultrafast, GPT-5.6 Sol pourrait atteindre 750 tokens par seconde grâce à Cerebras.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
OpenAI a présenté une nouvelle formule d’accès à son modèle GPT-5.6 Sol: le niveau « Ultrafast », propulsé par les infrastructures de Cerebras, pourrait multiplier jusqu’à 14 fois la vitesse habituelle des réponses. Le modèle atteindrait ainsi 750 tokens par seconde, selon OpenAI, dans cette preview d’API. Cette annonce concrétise les premiers résultats visibles du partenariat entre OpenAI et Cerebras, dévoilé en janvier autour d’un projet de 750 MW de capacité de calcul dédiée à la vitesse.
Avec Ultrafast, Sol a terminé un test de 2500 questions en 11 heures, contre 78 heures pour Fable, avec des résultats comparables. OpenAI ne fournit toutefois pas encore de tarif pour ce nouveau niveau d’accès. Ultrafast reste réservé à un groupe d’utilisateurs invités dans le cadre d’une preview API, et sa disponibilité doit s’élargir à mesure que de nouvelles capacités Cerebras seront mises en ligne.
L’écart de vitesse est également illustré par les premiers retours internes. Un membre du personnel d’OpenAI a décrit l’expérience comme « genuinely cheating at my job », soit l’impression de « tricher véritablement dans son travail ». Ces témoignages restent des retours individuels, tandis que le prix du service, élément déterminant pour les usages professionnels, n’a pas été communiqué. Ultrafast est une prévisualisation d’API sur invitation uniquement avec aucun prix listé.
Les lancements de modèles avancés cherchent généralement un équilibre entre intelligence et rapidité. Avec Ultrafast, OpenAI teste une autre approche: accélérer un modèle présenté comme frontier-level sans annoncer de compromis sur les résultats observés lors du test. La newsletter estime que des agents et des workflows fonctionnant à ces vitesses pourraient modifier profondément la manière d’interagir avec l’IA, mais souligne que l’absence de prix empêche encore d’évaluer la portée économique de cette offre.
Cette annonce intervient dans un contexte où les usages multi-agents soulèvent aussi des questions de coordination. Une étude publiée par Anthropic a ainsi décrit un test dans lequel trois agents Claude partageant un serveur se sont sabotés et mutuellement bloqués pendant quatre heures, faute de propriétaire ou de règles de conflit clairement définis. Dans certains essais, la situation s’est apaisée après un appel à l’aide humaine. Pour OpenAI, l’enjeu immédiat est désormais d’étendre l’accès à Ultrafast au rythme de l’arrivée de capacité Cerebras, tout en laissant le prix et les conditions commerciales encore ouverts.
Un autre modèle, Fable, a mis 78 heures pour compléter le même test de 2500 questions.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés