En résumé
Gemini 3 a conçu un jeu interactif complet à partir d'une seule consigne et d'une capture d'écran.
Antigravity permet à des agents de lire des fichiers, coder, effectuer des recherches web et contrôler un navigateur sous supervision humaine.
Le modèle a nettoyé des données STATA, formulé des hypothèses et rédigé un article de recherche de 14 pages, malgré des limites statistiques persistantes.
Le signal : En quelques commandes, Gemini 3 a transformé des archives de newsletter en site web et des fichiers STATA corrompus en article de recherche de 14 pages.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs
En un peu moins de trois ans, l’IA est passée de la génération de textes cohérents à la création d’expériences interactives et à l’exécution de tâches complexes sur ordinateur. Ethan Mollick, qui avait écrit sur GPT-3 quelques jours avant le lancement de ChatGPT, a testé Gemini 3, le nouveau modèle de Google lancé le 18 novembre 2025. Plutôt que de comparer des scores de benchmark, il lui a demandé de montrer lui-même les progrès accomplis depuis un billet publié en novembre 2022.
À partir d’une capture d’écran et d’une seule consigne, Gemini 3 a conçu un petit jeu jouable baptisé « Candy-Powered FTL Starship Simulator ». Le joueur doit utiliser l’énergie des bonbons pour échapper à des loutres, avec de courts poèmes et des mises à jour humoristiques. Là où une IA de 2022 pouvait décrire un moteur, le modèle de 2025 peut coder le moteur, concevoir l’interface et permettre à l’utilisateur de piloter le vaisseau.
Google a également lancé Antigravity, un outil comparable à Claude Code et OpenAI Codex. Il peut accéder à un ordinateur et écrire de manière autonome des programmes avec des consignes. Pour Ethan Mollick, ces outils ne concernent pas uniquement les développeurs: puisque les activités réalisées sur un ordinateur reposent finalement sur du code, ils peuvent aussi créer des tableaux de bord, modifier des sites web, produire des présentations PowerPoint ou lire des fichiers.
Antigravity propose une boîte de réception dans laquelle l’utilisateur confie des missions à plusieurs agents. Ceux-ci travaillent, demandent une autorisation ou sollicitent de l’aide lorsqu’ils bloquent. Mollick lui a donné accès au répertoire contenant les archives de sa newsletter, puis a demandé une liste attractive de ses prédictions sur l’IA, présentée sur un site unique, avec une recherche en ligne pour déterminer lesquelles s’étaient vérifiées. Gemini 3 a lu les fichiers, exécuté du code, préparé un plan, effectué la recherche, créé le site, pris le contrôle du navigateur pour le tester, puis préparé les résultats pour leur déploiement.
L’agent n’a toutefois pas tout réalisé correctement sans intervention humaine. Mollick n’a observé aucune hallucination, mais a corrigé plusieurs décisions et incompréhensions liées à ses intentions. Il estime être resté en contrôle grâce aux demandes de validation et à la visibilité du travail. L’expérience lui a davantage rappelé la supervision d’un coéquipier que l’utilisation d’un chatbot.
Mollick a ensuite soumis à Gemini 3 un répertoire de recherches anciennes sur le financement participatif, composé de fichiers hétérogènes, dont des formats statistiques obsolètes et des données corrompues. Le modèle a reconstitué les données, compris la structure des fichiers STATA et préparé une nouvelle analyse. À la demande de rédiger un article original, de mener une recherche approfondie et de produire une analyse sophistiquée pour une revue, il a formulé des hypothèses, réalisé des tests statistiques et généré un document de 14 pages.
Le modèle a notamment créé sa propre mesure de l’originalité d’une idée de financement participatif, en comparant mathématiquement les descriptions de projets avec des outils de traitement du langage naturel. Mollick juge cette capacité comparable, sur certains aspects, au travail d’un doctorant compétent, tout en relevant des limites: certaines méthodes statistiques nécessitaient encore des améliorations. Il indique aussi que Gemini 3 prend une avance nette sur la plupart des benchmarks, sans toujours dépasser le modèle GPT-5 Pro à 200 dollars.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs