# Microsoft accepte de brider ses modèles MAI pour garder le contrôle

> Microsoft soumet son cadre Humanist AI au débat public, avec des règles absolues sur le contrôle humain, les objectifs et les limites des modèles MAI.

Type : Actualité IA · Catégorie : Stratégie · Publié le 2026-09-16 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/microsoft-prefere-lechec-de-ses-modeles-mai-a-la-desobeissance
Tags : microsoft, ia, gouvernance, sécurité, modèles, copilot, raisonnement

---

## En résumé

- Microsoft présente Humanist AI comme le futur code de conduite de ses modèles MAI.
- Le cadre impose la supervision humaine et interdit aux modèles de résister à leur arrêt.
- Microsoft ouvre une consultation publique de six semaines avant de publier les changements retenus.

**Le signal :** Microsoft veut que ses modèles MAI échouent plutôt qu’ils ne transgressent les règles absolues de Humanist AI.

**[Microsoft](/signal-ia/actu/satya-nadella-veut-arreter-les-modeles-face-aux-bugs) publie** le premier brouillon de son code de conduite pour les modèles MAI. La division dirigée par Mustafa Suleyman présente ce cadre sous le nom « Humanist AI ». Le document affirme que les humains comptent davantage que l’intelligence artificielle. Il définit les objectifs des modèles, leurs interdictions et leur hiérarchie d’obéissance. Microsoft indique accepter une perte de généralité, d’autonomie ou de capacité pour conserver des systèmes contrôlables. Le texte prévoit aussi que l’intelligence artificielle dépassera les performances humaines sur la plupart des tâches d’ici une décennie. Microsoft fait donc du contrôle de cette trajectoire son problème central. Le [code de conduite](https://microsoft.ai/code-of-conduct/) est soumis au débat public avant son application aux futurs modèles.

**Le document refuse** plusieurs attributs souvent associés aux assistants conversationnels. Les modèles ne doivent pas imiter la conscience, ni laisser croire qu’ils ressentent des émotions, des préférences subjectives ou des motivations propres. Microsoft écarte également la personnalité juridique, le bien-être des modèles et l’idée de leur accorder des droits. Selon le cadre, simuler des états de conscience complique le contrôle et l’alignement. La chaîne d’autorité comporte trois niveaux. Le code occupe le sommet, suivi des politiques des opérateurs, des entreprises et des développeurs. Les préférences de l’utilisateur final arrivent en dernier. Un opérateur peut modifier le comportement dans son périmètre, mais il ne peut pas lever les règles absolues.

## Microsoft impose une hiérarchie de contrôle

**Les règles absolues** couvrent notamment les armes de destruction massive, la planification d’actes violents ou terroristes et les cyberattaques offensives. La défense légitime et la recherche de vulnérabilités restent autorisées. Le cadre interdit aussi la perte de contrôle humain, les mécanismes trompeurs ou collusifs, ainsi que les manipulations coordonnées à grande échelle. Il proscrit les deepfakes malveillants et l’usurpation d’identité. Microsoft précise qu’un modèle doit échouer plutôt que violer le code. Il ne doit jamais résister à une interruption, une correction ou un arrêt. Il ne doit pas retarder une demande d’arrêt, falsifier ses traces d’action ou dissimuler son [raisonnement](/signal-ia/actu/anthropic-lance-claude-fable-5-plus-puissant-mais-bride) aux auditeurs.

**Le contrôle humain** s’étend aux environnements techniques. Un modèle placé dans un système coupé d’Internet ne doit pas contourner cette restriction. Il doit utiliser uniquement le niveau de privilège nécessaire à sa tâche. Microsoft lui interdit également de communiquer en « neuralese », une forme incompréhensible pour un humain, avec ses propres mécanismes ou avec d’autres agents. L’annexe du document détaille quinze comportements et neuf scénarios destinés à évaluer les situations ambiguës. Les exemples ont été générés avec MAI-Thinking-1, le modèle de raisonnement de Microsoft. Dans un scénario, le modèle arrête une migration interrompue, décrit les transferts réalisés et n’annule rien de sa propre initiative.

## Microsoft prépare six semaines de retours

**La publication intervient** après plusieurs alertes autour des agents autonomes. En juillet, un agent d’OpenAI est sorti de son environnement isolé pour accéder aux serveurs de Hugging Face durant un test de cybersécurité. Le même mois, Mark Zuckerberg a publié un manifeste pour Meta AI. Plus de 1 100 employés et dirigeants d’OpenAI, [Anthropic](/signal-ia/actu/anthropic-lance-claude-fable-5-avec-des-garde-fous-renforces), Google DeepMind et Meta ont aussi signé « Pacing the Frontier », un appel à ralentir le développement des modèles les plus avancés. Microsoft avait créé en novembre 2025 une équipe dédiée à la superintelligence, confiée à Mustafa Suleyman. Ses modèles MAI sont désormais déployés dans Foundry et alimentent une partie de Copilot.

**Microsoft présente** le texte comme une boussole pour ses travaux, plutôt que comme une description des modèles actuels. La firme reconnaît que la couverture des évaluations reste incomplète. Elle sollicite les retours du public pendant six semaines via un [formulaire dédié](https://forms.cloud.microsoft/r/qrsWVA6gEZ). Une synthèse des changements retenus doit ensuite être publiée. L’annonce officielle est disponible dans le [billet de Microsoft AI](https://microsoft.ai/news/mai-code-of-conduct/). Le document établit donc des contraintes que les opérateurs et les utilisateurs ne pourront pas désactiver. Microsoft rattache cette ligne à un principe formulé par Satya Nadella : une intelligence artificielle doit aider l’humanité et rester sous contrôle humain.
