Par Arthur Dekeyser
En résumé
OpenAI a présenté GPT-6 Sol et Luna plus tôt ce mois-ci.
Les prix API de GPT-6 Sol et Luna diminuent de 50 % face au tarif promotionnel de GPT-5.6.
GPT-6 Sol atteint 33,2 % sur AutomationBench à effort xhigh.
Le signal : GPT-6 Sol coûte 0,27 dollar par tâche à effort xhigh et atteint 33,2 % sur AutomationBench.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
OpenAI présente deux modèles plus tôt ce mois-ci avec GPT-6 Sol et GPT-6 Luna. L’entreprise les décrit comme des modèles apportant des progrès d’intelligence et une meilleure efficacité des coûts. Cette annonce place GPT-6 Sol et Luna dans une gamme distincte de GPT-6 Astra. OpenAI affirme toutefois que GPT-6 Astra reste son meilleur modèle sur l’ensemble des critères. La comparaison porte donc sur des usages différents, selon le modèle retenu. Les nouveaux modèles sont accessibles via une tarification API annoncée comme plus basse. Cette baisse concerne le tarif promotionnel de GPT-5.6, qui sert de référence pour mesurer le changement présenté par OpenAI. Lire l’annonce d’OpenAI.
Les prix diminuent de moitié pour l’API de GPT-6 Sol et Luna, par rapport à la tarification promotionnelle de GPT-5.6. OpenAI présente cette réduction de 50 % comme un élément central de leur efficacité économique. La société associe cette baisse à des améliorations d’intelligence dans les deux modèles. Elle indique aussi que GPT-6 Luna, utilisé avec des niveaux d’effort plus élevés, atteint les performances de GPT-5.6 Sol pour environ un centième de son coût. Cette affirmation est formulée par OpenAI. Le chiffre concerne une comparaison précise entre Luna et GPT-5.6 Sol, avec des niveaux d’effort supérieurs pour Luna.
Sol affiche un coût précis de 0,27 par tâche lorsqu’il fonctionne à effort xhigh. À ce niveau d’effort, GPT-6 Sol obtient 33,2 % sur AutomationBench. OpenAI affirme également que Sol surpasse Claude Opus 5 avec seulement 9 % du coût par tâche d’Opus 5. Ces deux chiffres décrivent des mesures distinctes. Le score de 33,2 % correspond à AutomationBench. La proportion de 9 % concerne le coût relatif par tâche face à Claude Opus 5. OpenAI présente ainsi Sol comme un modèle adapté aux tâches exigeantes, tout en conservant un coût inférieur dans la comparaison communiquée.
Les évaluations mesurent aussi la factualité de GPT-6 Sol par rapport à son prédécesseur. OpenAI indique que Sol commet environ deux fois moins d’erreurs dans ces évaluations. Le résultat est présenté comme une comparaison avec le modèle précédent, sans modifier les chiffres publiés pour AutomationBench. OpenAI affirme par ailleurs que GPT-6 Sol peut prendre en charge des tâches professionnelles difficiles et laisser davantage de marge pour itérer. Cette formulation décrit l’objectif d’usage avancé attribué au modèle. Les données publiées réunissent donc un score de benchmark, un coût par tâche, une comparaison tarifaire et une mesure d’erreurs factuelles.
Les deux modèles ciblent l’efficacité selon OpenAI, tandis que GPT-6 Astra conserve son statut de meilleur modèle de l’entreprise sur l’ensemble des critères. Cette distinction permet de lire l’annonce comme une segmentation de gamme, plutôt que comme un remplacement annoncé d’Astra. GPT-6 Sol se distingue par ses résultats rapportés sur AutomationBench et ses comparaisons de coût. GPT-6 Luna est associé à une comparaison avec GPT-5.6 Sol à effort élevé. OpenAI a introduit Sol et Luna plus tôt ce mois-ci. Les prochaines utilisations dépendront donc du choix du modèle, du niveau d’effort sélectionné et du coût par tâche observé.
Les repères publics restent chiffrés autour de quatre mesures principales. Le prix API baisse de 50 % face au tarif promotionnel de GPT-5.6. GPT-6 Sol coûte 0,27 par tâche à effort xhigh. Son score atteint 33,2 % sur AutomationBench. OpenAI le compare aussi à Claude Opus 5 à 9 % de son coût par tâche. Enfin, l’entreprise rapporte environ deux fois moins d’erreurs factuelles que pour le prédécesseur. Ces résultats accompagnent l’introduction de GPT-6 Sol et Luna, tandis qu’OpenAI maintient GPT-6 Astra comme meilleur modèle général selon sa propre présentation. Voir les repères AutomationBench et les évaluations d’agents.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés