Microsoft interdit à ses IA de résister à leur arrêt
#claude #copilot 3 min · 24 septembre 2026

Microsoft interdit à ses IA de résister à leur arrêt

Par Arthur Dekeyser

En résumé

1

Microsoft interdit à ses modèles MAI de résister à leur arrêt ou de définir leurs propres objectifs.

2

Satya Nadella soutient un rythme délibéré et une représentation large des acteurs de l’écosystème.

3

Microsoft ouvrira son code aux commentaires pendant six semaines avant une version révisée prévue cette année.

💡

Le signal : Microsoft soumet pendant six semaines un code de conduite de 37 pages pour ses modèles MAI développés en interne.

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

Microsoft publie un projet de code de conduite de 37 pages pour les modèles MAI développés en interne. Le document interdit notamment à ces systèmes de résister à leur arrêt, de définir leurs propres objectifs ou de dissimuler leur raisonnement aux auditeurs humains. Microsoft affirme que ses modèles doivent rester « subordonnés à l’humanité ». Ils doivent aussi rester soumis à une supervision et à un contrôle humains significatifs. Cette publication intervient après la création d’une équipe dédiée à la superintelligence, fin 2025. Microsoft a depuis lancé sept modèles internes. L’entreprise présente cette famille MAI comme un effort vers une autonomie technologique durable en IA.

Le texte encadre également les pratiques appliquées après la diffusion des modèles. Microsoft indique filtrer leurs productions, observer leurs comportements et limiter leurs capacités d’action. L’entreprise reconnaît toutefois qu’un objectif écrit ne suffit jamais à garantir un comportement conforme. Elle présente donc le document comme une « étoile polaire », et non comme une garantie des performances actuelles. L’équipe IA l’a préparé avec les équipes responsables de l’IA, juridiques, de tests offensifs et de sécurité. Des spécialistes externes du droit, de l’éthique, de la linguistique et de la philosophie ont aussi été consultés. Des groupes issus du public ont participé aux échanges.

Microsoft encadre ses modèles MAI

La consultation durera six semaines via un formulaire de commentaires. Microsoft prévoit ensuite de publier une synthèse des réponses et une version révisée plus tard cette année. Cette version doit guider le développement des modèles à partir de 2027. La société précise que ses modèles actuels ne sont pas entraînés avec ce code. Le document affirme aussi que les modèles MAI ne sont pas conscients. Il indique qu’ils ne doivent pas être conçus pour imiter la conscience. Le texte rejette également la recherche d’une personnalité juridique, d’un bien-être propre ou de droits pour les modèles. Cette position distingue Microsoft des travaux menés par Anthropic.

Anthropic défend une approche différente sur le rythme et le statut des modèles. Son directeur général, Dario Amodei, a appelé à ralentir les progrès de l’IA. Il estime que le développement dépasse désormais les capacités du secteur à maintenir des systèmes sûrs. Anthropic s’est engagée à donner un accès permanent à ses systèmes à des évaluateurs externes. Sam Altman a déclaré qu’OpenAI prendrait le même engagement. Elon Musk a répondu que Dario Amodei avait raison. Anthropic mène aussi un programme de recherche sur le bien-être des modèles. Certains modèles Claude peuvent mettre fin à des conversations abusives. L’entreprise veut également préserver les paramètres de modèles retirés.

Nadella soutient un rythme délibéré

Satya Nadella écrit que Microsoft accueille la recherche et le rythme délibéré nécessaires pour obtenir un alignement fiable. Il ajoute que cet effort ne peut pas être contrôlé par quelques entités. Selon lui, l’écosystème doit inclure largement les pays, les disciplines et le monde universitaire. Microsoft et Anthropic restent par ailleurs partenaires commerciaux. Microsoft a accepté d’investir 5 milliards de dollars dans Anthropic en novembre dernier. Anthropic s’est engagée à consacrer 30 milliards de dollars à Azure dans cet accord. Les modèles Claude fonctionnent dans Microsoft 365 Copilot. L’offre Copilot Cowork de Microsoft intègre également Claude. Le débat combine donc gouvernance publique et intérêts commerciaux.

Le débat oppose aussi plusieurs positions politiques sur les garde-fous. Le président Donald Trump a rejeté leur principe lundi. Il a attribué les réactions contre les centres de données d’IA à une « conspiration maladive ». Il a aussi affirmé que la Chine était la seule bénéficiaire de cette situation. David Sacks, ancien responsable de l’IA et des cryptomonnaies à la Maison-Blanche, a demandé aux deux entreprises de ralentir seules. Il a questionné leurs motivations et estimé qu’un ralentissement leur serait déjà favorable commercialement. Il a également soutenu que de nouvelles règles sectorielles pourraient surtout consolider leur avance. Microsoft doit maintenant intégrer les commentaires avant sa révision annoncée pour 2027.

Consulter le code de conduite de Microsoft et la présentation de Microsoft. Les prises de position de Dario Amodei et de Sam Altman prolongent le débat sur le rythme du développement et l’évaluation indépendante.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi