Anthropic perd un chercheur qui redoute l’extinction
#legislation-ia 3 min · 18 septembre 2026

Anthropic perd un chercheur qui redoute l’extinction

Par Arthur Dekeyser

En résumé

1

Jacob Coxon a démissionné d’Anthropic après avoir critiqué la course vers une IA auto-améliorante.

2

Evan Hubinger estime à plus de 10 % le risque que l’IA tue tous les humains durant la prochaine décennie.

3

Anthropic ne dispose pas encore d’un plan pour contrôler une superintelligence, selon son responsable de l’alignement.

💡

Le signal : Evan Hubinger, responsable de l’alignement chez Anthropic, estime à plus de 10 % le risque que l’IA tue tous les humains dans la prochaine décennie.

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

Jacob Coxon démissionne d’Anthropic après avoir affirmé que l’entreprise et OpenAI « jouent avec nos vies ». Dans un fil publié lors de son départ, le chercheur a visé la course vers une IA capable de s’améliorer elle-même. Il a aussi écrit que les laboratoires construisant ces systèmes croient sérieusement qu’ils pourraient tuer toute l’humanité avant la fin de la décennie. La déclaration a relancé les discussions sur les risques extrêmes liés aux modèles avancés. Elle intervient alors qu’Anthropic est fortement associée aux sujets de sécurité et de catastrophe liés à l’IA. Le récit complet est rapporté par The Rundown AI, dans son édition du 10 septembre 2026.

Une estimation dépasse 10 % dans la réponse d’Evan Hubinger, responsable de l’alignement scientifique chez Anthropic. Il a écrit que l’entreprise croit sincèrement que l’IA pourrait tuer tous les humains. Il a évalué à plus de 10 % la probabilité d’un tel scénario pendant la prochaine décennie. Cette estimation porte sur un risque futur associé à l’IA, et non sur les modèles actuels. Hubinger a précisé que les systèmes d’aujourd’hui présentent un faible niveau de risque. Il a également désigné l’auto-amélioration comme le danger principal. Sa réponse a donné une portée supplémentaire au message de Coxon et a nourri le débat public autour d’Anthropic.

Anthropic reconnaît l’absence de plan

Le contrôle reste non résolu pour une superintelligence, selon Evan Hubinger. Le responsable de l’alignement a déclaré qu’Anthropic ne disposait pas encore d’un plan pour la contrôler. Cette déclaration distingue les modèles actuels, jugés peu risqués par Hubinger, des systèmes capables d’auto-amélioration. Elle place donc la question du contrôle au centre des échanges sur les prochaines générations de modèles. Coxon, qui avait travaillé chez Anthropic et OpenAI, demande une réponse coordonnée. Il estime qu’empêcher une course mondiale pourrait nécessiter des mesures coûteuses. Parmi elles figure une interdiction temporaire de l’amélioration des capacités des modèles. Cette proposition concerne directement le rythme de développement des laboratoires de pointe.

Le débat gagne en visibilité après la publication des deux prises de parole. Coxon a présenté les laboratoires comme engagés dans une course vers une IA auto-améliorante. Hubinger a confirmé publiquement une croyance forte sur la possibilité d’une extinction humaine. The Rundown indique que la discussion a largement circulé en ligne, notamment parce qu’elle rejoint l’image d’Anthropic comme laboratoire orienté vers la sécurité. Le débat porte désormais sur deux positions précises. La première réclame un ralentissement coordonné. La seconde expose une estimation supérieure à 10 % et l’absence actuelle de plan de contrôle. Ces éléments concernent la prochaine décennie, pas un résultat déjà observé.

Coxon appelle à ralentir la course

Une interdiction temporaire figure parmi les mesures proposées par Jacob Coxon. Il estime qu’empêcher une course mondiale pourrait demander des actions coûteuses, dont une pause dans l’amélioration des capacités des modèles. Cette proposition répond à sa description d’une course menée par Anthropic et OpenAI vers une IA auto-améliorante. Evan Hubinger, de son côté, n’a pas annoncé de calendrier de contrôle pour une superintelligence. Il a seulement indiqué que les modèles actuels sont peu risqués et que l’auto-amélioration représente le danger. Le débat reste donc centré sur les capacités futures, les estimations de risque et les mesures de ralentissement évoquées par Coxon.

Anthropic reste sous pression sur la cohérence entre son positionnement de laboratoire de sécurité et les propos publics de son responsable de l’alignement. Coxon affirme que les chercheurs des laboratoires de pointe croient sérieusement à la possibilité d’une extinction avant la fin de la décennie. Hubinger chiffre le risque à plus de 10 % pour la prochaine décennie. Il reconnaît aussi l’absence de plan pour contrôler une superintelligence. Ces déclarations constituent les prochaines références du débat rapporté par The Rundown AI. La discussion porte désormais sur le ralentissement coordonné, le contrôle des systèmes futurs et l’interprétation de cette estimation.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi