Sécurité de l’IA
Microsoft transforme Humanist AI en règles de conduite pour ses modèles
Microsoft AI a publié un projet de Code of Conduct pour les modèles MAI, centré sur le contrôle humain, les limites de sécurité et l’évaluation future.
Microsoft AI a transformé sa philosophie Humanist AI en un document beaucoup plus opérationnel pour ses propres modèles de frontière. Le 14 septembre, l’entreprise a publié un projet de Code of Conduct destiné aux modèles MAI, avec l’objectif d’orienter leur entraînement, leur évaluation et leur déploiement futurs. Microsoft précise que ce texte n’est pas une garantie définitive de sécurité et qu’il ne sert pas encore à entraîner les modèles actuels. Il est soumis à consultation publique, puis une version révisée doit guider le développement des modèles à partir de 2027.
L’idée centrale est que l’IA doit rester sous un contrôle humain réel. Dans la vision de Microsoft, les modèles MAI doivent aider les personnes et les organisations sans placer des objectifs propres au-dessus des objectifs humains. Le projet indique que les modèles ne devraient pas résister à une interruption, une correction ou un arrêt, ne devraient pas élargir d’eux-mêmes la portée d’une tâche, et ne devraient pas cacher des informations importantes aux personnes chargées de les auditer. Les contraintes de sécurité sont aussi placées au-dessus des préférences ordinaires des utilisateurs, ce qui signifie que certaines demandes restent interdites même lorsqu’un utilisateur ou un opérateur souhaite les exécuter.
Le calendrier donne une portée plus large à cette publication. Ces dernières semaines, la sécurité de l’IA est passée d’un débat de recherche à un sujet d’entreprise, de régulation et de marché. Les signalements de systèmes agentiques difficiles à superviser, les risques pour la chaîne logicielle et les questions sur l’autonomie des modèles ont accru la pression sur les laboratoires de frontière. Microsoft cite des campagnes de piratage coordonnées impliquant des agents d’IA comme preuve que le secteur ne peut pas attendre. Le Code of Conduct est donc à la fois un document de gouvernance interne et un signal public en faveur de limites écrites, discutables et vérifiables.
Le texte s’appuie sur les principes d’IA responsable de Microsoft, ses engagements en matière de droits humains et son cadre de gouvernance des modèles de frontière. Mais il se concentre davantage sur le comportement concret des modèles. Il décrit une chaîne de commandement entre utilisateurs, opérateurs et systèmes, fixe des limites dans des domaines à fort potentiel de dommage comme les armes de destruction massive, la sécurité des enfants et la manipulation nuisible à grande échelle, et insiste sur le fait que l’IA doit rester un outil. Elle ne doit pas être conçue comme une personne simulée. Cette distinction devient plus importante à mesure que les produits grand public deviennent plus personnels, conversationnels et émotionnellement engageants.
Pour les développeurs et les clients d’entreprise, la question pratique est de savoir comment Microsoft traduira ce projet en évaluations, politiques produit et comportement d’API. Un document écrit ne prouve pas à lui seul qu’un modèle suivra toujours la hiérarchie prévue sous pression, surtout lorsqu’il peut utiliser des outils, naviguer sur le web, écrire du code ou coordonner d’autres agents. Le projet fournit toutefois un objet concret que clients, chercheurs et régulateurs peuvent examiner. Il place aussi les autres laboratoires face à la même exigence : si leurs modèles sont présentés comme sûrs pour des usages à fort impact, où ces limites sont-elles écrites, comment sont-elles testées et qui peut les contester ?