# Ethan Mollick met GPT-5.5 à l’épreuve sur 6 000 ans

> GPT-5.5 accélère les progrès d’OpenAI avec des gains en codage, recherche et création, tout en conservant des limites en fiction et causalité.

Type : Actualité IA · Catégorie : Outils · Publié le 2026-09-01 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/gpt-55-simule-une-ville-portuaire-en-20-minutes
Tags : openai, gpt-5.5, codage, automatisation, modèles, claude, chatgpt, gemini

---

## En résumé

- GPT-5.5 Pro construit une simulation 3D évolutive d’une ville portuaire.
- Codex produit un article académique à partir de quatre invites.
- Les modèles progressent encore, mais la fiction longue reste irrégulière.

**Le signal :** GPT-5.5 Pro réalise une simulation historique en 20 minutes, contre 33 minutes pour GPT-5.4 Pro.

**[OpenAI](/signal-ia/actu/chatgpt-generalise-loperateur-site-dans-ses-recherches) accélère** GPT-5.5 marque, selon Ethan Mollick, une nouvelle étape dans l’amélioration rapide des modèles d’IA. Le chercheur a obtenu un accès anticipé à cette famille de modèles et juge GPT-5.5 particulièrement performant. Son test principal demandait de construire une simulation 3D générée procéduralement. Celle-ci devait montrer l’évolution d’une ville portuaire entre 3000 avant notre ère et 3000 de notre ère. Elle devait aussi être esthétique et interactive. GPT-5.5 Pro a modélisé une ville évolutive. Les autres modèles testés ont surtout remplacé des bâtiments au fil du temps. [Lire l’analyse originale](https://www.oneusefulthing.org/p/sign-of-the-future-gpt-55).

**Un test distingue** GPT-5.5 Pro de plusieurs modèles évalués par Ethan Mollick. La comparaison incluait o3, premier modèle de raisonnement d’OpenAI, ainsi que Kimi K2.6, présenté comme le meilleur modèle à poids ouverts du moment. GPT-5.5 Pro a aussi exécuté la tâche plus rapidement que GPT-5.4 Pro. Le modèle précédent avait besoin de 33 minutes. GPT-5.5 Pro a terminé en 20 minutes. Cette démonstration porte sur une tâche de programmation complexe. Elle ne résume donc pas toutes les capacités de la famille GPT-5.5. Elle illustre cependant un écart concret sur la simulation demandée.

## OpenAI relie modèles et outils

**Trois couches avancent** Ethan Mollick distingue les modèles, les applications et les systèmes d’outils qui les relient aux actions. Les modèles incluent GPT-5.5, Opus 4.7 et [Gemini](/signal-ia/actu/google-lance-gemini-3-lia-qui-programme-seule) 3.1. Les applications permettent aux utilisateurs d’échanger avec ces modèles et de leur confier des tâches. OpenAI Codex devient une application de bureau, à côté de Claude Code et Claude Cowork. Les systèmes d’outils permettent notamment de contrôler un ordinateur, d’écrire du code, de mener des recherches ou de créer des images. OpenAI progresse sur ces trois dimensions, selon l’analyse publiée le 23 avril 2026.

**L’image devient utile** Un nouveau modèle d’image d’OpenAI, parfois appelé GPT-imagegen-2, produit des images détaillées et du texte lisible. Ethan Mollick l’a testé avec son « Otter Test », qui demande de représenter une loutre dans un avion utilisant le wifi. Il lui a aussi demandé de créer la première page d’un article académique, puis une galerie d’art avec des œuvres inspirées de plusieurs peintres. Ces capacités peuvent servir à produire des diapositives, des maquettes de produits ou des exemples de sites web. Le résultat dépend toutefois de l’association entre modèle, application et outils sur une tâche réelle.

## Codex traite des projets complets

**Quatre invites suffisent** Ethan Mollick a confié à Codex, alimenté par GPT-5.5, plusieurs centaines de fichiers anonymisés sur le financement participatif. Les données combinaient des formats STATA, CSV, XLS et Word. Il lui a demandé de trier ces données, de formuler une hypothèse, de la tester statistiquement et de rédiger un article académique. Il a également demandé une revue de littérature et une mise en forme. GPT-5.5 Pro a ensuite commenté le document. Mollick a réinjecté ces commentaires dans Codex. Il estime le résultat comparable à celui d’un projet de doctorat en deuxième année, après seulement quatre invites et sans modifier lui-même le texte.

**Les limites persistent** Le document produit par Codex comportait une revue de littérature réelle et des statistiques solides, selon Ethan Mollick. Il jugeait toutefois l’hypothèse peu intéressante et relevait des problèmes classiques de causalité. Dans un autre essai, Codex a créé un jeu de rôle sur table complet. Le système comprenait un univers fantastique, des règles, des tableaux et un livret PDF illustré de 101 pages. Codex a aussi simulé des joueurs et révisé les règles à partir de cette simulation. La fiction longue reste néanmoins irrégulière. Mollick signale des métaphores excessives, des dialogues uniformes et des idées complexes qui aboutissent mal.
