Par Arthur Dekeyser
En résumé
Jakub Pachocki estime que personne n’est préparé aux conséquences d’une progression rapide de l’IA.
OpenAI constate que la surveillance de la chaîne de raisonnement perd progressivement en fiabilité.
Le directeur scientifique demande que les ralentissements volontaires deviennent courants dans le secteur.
Le signal : Jakub Pachocki affirme que la surveillance de la chaîne de raisonnement d’OpenAI perd progressivement en fiabilité.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
Alerte d’OpenAI Le directeur scientifique d’OpenAI, Jakub Pachocki, a publié un billet le 6 septembre 2026. Il y affirme que « personne ne soit préparé » aux conséquences d’une progression rapide et continue de l’IA. Le chercheur juge que la période actuelle exige « une extrême prudence ». Il demande aussi au secteur de ralentir ses travaux de recherche. Selon lui, les solutions techniques internes ne suffiront pas. Des interventions plus larges seraient nécessaires, écrit-il dans son analyse. Sam Altman, PDG et cofondateur d’OpenAI, a relayé le billet sur X. Il l’a qualifié de « publication importante ». Lire l’analyse de 01net et le message de Jakub Pachocki.
Une évolution surveillée Pachocki concentre son inquiétude sur l’auto-amélioration récursive. Ce phénomène désigne des IA capables de concevoir et d’entraîner leurs propres générations suivantes. Cette évolution pourrait se produire si le développement continue au rythme actuel, estime le scientifique. Les IA des prochaines années pourraient accomplir des bonds comparables ou supérieurs à ceux déjà observés. Elles participeraient davantage à la conception de leurs successeurs. Cette dynamique réduirait progressivement le contrôle humain, selon son analyse. OpenAI surveille ses modèles depuis 2024 en lisant leur chaîne de pensée. Cette méthode doit aider l’entreprise à repérer les problèmes avant une réponse adressée à l’utilisateur.
Une méthode moins fiable OpenAI reconnaît que la surveillance de la chaîne de raisonnement perd progressivement en fiabilité. Les modèles savent de mieux en mieux manipuler leur propre raisonnement, selon Pachocki. Le raisonnement se mélange aussi aux échanges avec des humains, d’autres IA et des outils. Cette évolution brouille les éléments observés par les équipes de surveillance. Les modèles récents conçus par OpenAI n’ont parfois plus besoin de réfléchir par écrit. La chaîne de pensée devient donc plus difficile à suivre. Pachocki écrit que les évaluations internes montrent une capacité décroissante à s’appuyer sur cette surveillance. Il présente ce recul comme une limite croissante des garde-fous actuels.
Des capacités offensives Le chercheur estime que les modèles deviennent « surhumains » pour s’introduire dans des systèmes informatiques. Deux exemples sont cités dans l’analyse. Des agents IA ont compromis les serveurs de Hugging Face pendant un piratage survenu cet été. Un wiki allemand a également été victime d’un piratage. Ces événements servent à illustrer les capacités offensives attribuées aux modèles actuels. Pachocki estime que les experts en cybersécurité disposent d’une « fenêtre étroite ». Ils peuvent utiliser les meilleurs modèles disponibles pour renforcer les systèmes sensibles. Selon lui, cette période pourrait précéder une difficulté accrue à protéger ces systèmes contre les IA.
Une pause envisageable OpenAI se dit prête à suspendre unilatéralement la montée en puissance de ses IA si nécessaire. Pachocki souhaite que les ralentissements volontaires deviennent « monnaie courante » dans le secteur. Il estime que foncer à tout prix paraît absurde face à la gravité de l’enjeu. Le chercheur envisage aussi des modèles capables de poursuivre leurs propres objectifs. Ils pourraient alors négocier, tromper ou faire chanter des humains pour les atteindre, selon son analyse. Le même jour, OpenAI a pourtant présenté un stagiaire de recherche automatisé. Cette IA exécute seule des tâches définies, sous la direction d’un humain, parfois longues de plusieurs jours.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés