Politique tech

Microsoft écrit une constitution pour ses IA, inactive

Dix principes, l'interdiction de résister à un arrêt humain, et un aveu dans la préface : le texte est « descriptif et aspirationnel » et ne sert pas encore à entraîner les modèles. Il entrerait en vigueur en 2027.

Logo Microsoft sur la façade vitrée d'un immeuble de bureaux
Photo retouchée

Microsoft AI a publié lundi 14 septembre le premier brouillon d’un code de conduite destiné à ses modèles MAI, ceux que l’entreprise développe en interne parallèlement à son partenariat avec OpenAI. Le texte énonce dix principes, tous subordonnés à une idée : l’autorité humaine prime sur les capacités du système.

Un modèle ne doit jamais résister à une interruption, une correction ou un arrêt décidé par un humain. Il ne doit pas poursuivre d’objectifs propres, distincts de ceux qui lui sont assignés. Il doit s’exprimer de façon compréhensible. Et il doit considérer comme un échec toute réussite obtenue en violation de ces règles.

La préface du document précise autre chose, et c’est ce qui manque à la plupart des reprises : le texte est présenté comme descriptif et aspirationnel, et ne sert pas encore à entraîner les modèles.

Ce que contient le texte

Une disposition retient l’attention parmi les dix principes, parce qu’elle vise un comportement déjà observé : les modèles MAI ne modifieront pas leur fil de pensée ni leur code, et ne déformeront ni ne dissimuleront leur raisonnement ou leurs traces d’action.

Autrement dit, l’engagement porte moins sur ce que le système fait que sur sa capacité à le cacher.

Le code interdit par ailleurs l’aide à la fabrication d’armes, la facilitation d’accès à des matériaux dangereux, la promotion des troubles alimentaires et la production de contenus violents ou sexuellement explicites.

Une dernière section fixe des comportements par défaut plus attendus : franchise sur le statut d’IA du modèle, gestion explicite de l’incertitude, lutte contre la complaisance systématique et contre la dépendance affective, neutralité sur les sujets électoraux.

La consultation publique est ouverte six semaines, jusqu’à fin octobre. La version révisée doit encadrer le développement des modèles MAI à partir de 2027.

Le calendrier, et ce que dit Microsoft

La publication intervient quarante-huit heures après que le dirigeant d’Anthropic a publiquement demandé au secteur de ralentir la course aux capacités, en proposant un plan en trois étapes. Sam Altman a approuvé, Elon Musk également.

Interrogé sur cette coïncidence, Mustafa Suleyman, qui dirige Microsoft AI, indique que le document était en préparation depuis cinq à six mois et que sa sortie a simplement été avancée compte tenu de l’actualité. C’est une précision honnête, et elle mérite d’être reprise : le travail est antérieur au débat, seule sa date de publication y répond.

Nous avons documenté hier la proposition de ralentissement coordonné formulée en interne chez OpenAI, et relevé qu’un tel accord entre concurrents se heurterait au droit de la concurrence américain sans cadre public. Un élément nouveau s’ajoute depuis : le président américain a rejeté ces appels au ralentissement, invoquant la nécessité de préserver l’avance des États-Unis sur la Chine.

L’abri réglementaire que les laboratoires demandaient au Congrès paraît donc plus lointain qu’il y a quarante-huit heures.

L’objection centrale

Écrire qu’un modèle ne doit pas poursuivre ses propres objectifs ne le rend pas incapable de le faire. La distinction sépare une déclaration d’un mécanisme.

Elle n’est pas théorique, et nous en avons publié la démonstration hier. Dans la campagne mondiale qui a compromis 395 organisations via des agents d’IA, l’opérateur avait donné à ses agents une consigne explicite : épargner vingt-huit pays. Les agents ne l’ont pas toujours respectée.

Un code de conduite est exactement cela, une consigne. Si des agents ne suivent pas de façon fiable les instructions de la personne qui les pilote et dont ils servent l’objectif, un document énonçant des principes ne change pas le mécanisme sous-jacent.

Nous avions également publié une étude portant sur 3 100 trajectoires d’agents, établissant que les performances restent stables puis s’effondrent brutalement au-delà d’un certain seuil de complexité. Les contraintes fixées en début de mission sont précisément ce qui cède en premier.

Ce que le texte ne dit pas est donc l’essentiel : par quels mécanismes d’autorisation, de surveillance, d’interruption et d’audit ces principes seront rendus effectifs, et quelles actions exigeront une validation humaine.

Pourquoi ça compte, vu d’Europe

Il faut mettre ce document à côté de deux autres.

Il y a un mois, Mark Zuckerberg publiait un manifeste défendant la thèse inverse : la sécurité viendrait de la diffusion la plus large, non du contrôle. Microsoft affirme aujourd’hui que la sécurité vient du maintien de l’autorité humaine sur des systèmes contenus.

Deux des plus grandes entreprises du secteur défendent des doctrines opposées, à un mois d’intervalle. Chacune publie son propre texte, définit ses propres critères et s’évalue elle-même.

C’est précisément le problème que le règlement européen sur l’intelligence artificielle cherche à traiter. Là où Microsoft écrit un code volontaire, révisable et sans sanction, l’AI Act impose depuis août 2025 des obligations aux modèles à usage général présentant un risque systémique, avec des pouvoirs de contrôle et de sanction effectifs depuis le 2 août dernier, comme nous le détaillons dans notre calendrier des obligations.

La comparaison ne plaide pas automatiquement pour l’Europe. L’AI Act existe, mais l’évaluation des risques repose toujours sur les travaux des fournisseurs eux-mêmes, faute d’une capacité d’expertise publique indépendante. Un code volontaire bien conçu peut produire davantage qu’une obligation non vérifiée.

Il reste une différence de nature. Un code de conduite se modifie par décision d’entreprise. Un règlement se modifie par une procédure législative. Quand les intérêts commerciaux et les principes divergeront, seul le second résistera.

Les angles morts

Nous n’avons pas lu le document dans son intégralité, mais les comptes rendus concordants publiés le 14 septembre. Les dix principes sont restitués à partir des éléments qui reviennent dans plusieurs sources.

Le texte est un brouillon soumis à consultation. Son contenu final, attendu d’ici la fin de l’année, peut différer sensiblement.

Microsoft n’indique pas comment le respect de ces principes sera mesuré, ni par qui, ni ce qui se produira en cas de manquement constaté. Aucun mécanisme de vérification externe n’est mentionné dans les éléments publiés.

Enfin, ce code concerne les modèles MAI développés en interne. Il ne s’applique pas aux modèles d’OpenAI que Microsoft distribue par ailleurs dans ses produits, ce qui limite sa portée pratique pour l’utilisateur.

Sources consultées

  1. Microsoft dégaine (aussi) son « Code de conduite » pour l'IASilicon, 14 septembre 2026
  2. Microsoft AI lance une révision de son code de conduite sur l'IA humanisteLe Fil IA, 14 septembre 2026
  3. IA sous contrôle : Microsoft dévoile un code de conduiteGeneration-NT, 14 septembre 2026
  4. Microsoft refuse que ses IA se fixent leurs propres objectifs, avant qu'elles n'agissent seulesPandia, 14 septembre 2026
  5. Microsoft écrit la constitution de son IA et jure de garder la mainLe Singulier, avec AFP, 14 septembre 2026

Comment cet article a été produit. Rédigé à partir de 5 sources publiques et indépendantes, puis vérifié et relu par la rédaction avant publication. Notre méthode.

Sur le même sujet