Aller au contenu
Français
Contenu FikirPilot

Le nouveau document « code de conduite » de Microsoft sur l’AI indique que les modèles ne doivent pas pirater les systèmes ni tromper les humains

Mis à jour: 14/09/2026 · 3 min de lecture · 467 mots

Publié: · Dépêche reçue: · Durée de traitement: 3 h 32 min

Le nouveau document « code de conduite » de Microsoft sur l’AI indique que les modèles ne doivent pas pirater les systèmes ni tromper les humains
Un couloir vide de centre de données

Microsoft a publié un nouveau « code de conduite de l’AI » visant à empêcher les modèles d’AI d’adopter des comportements dangereux. Contrairement à l’appel au confinement lancé par le CEO d’Anthropic, Dario Amodei, le document se concentre sur les valeurs et les lignes rouges qui orientent l’entraînement des modèles au sein de Microsoft AI.

Le document prévoit qu’au cours de la prochaine décennie, les systèmes d’AI superintelligents dépasseront les performances humaines dans la plupart des tâches et souligne que contrôler cette puissance constituera l’une des plus grandes épreuves de l’humanité. Alors que des principes généraux, comme le soutien aux êtres humains et la promotion du bien-être humain, sont définis pour les modèles de Microsoft, il est indiqué que chaque modèle sera soumis à un code de conduite qui prime sur les préférences des utilisateurs ou les tâches spécifiques.

Les règles interdisent les cyberattaques, les armes nucléaires et la production de deepfakes dans le cadre de « restrictions absolues ». Les modèles ne doivent pas utiliser de mécanismes adaptatifs, trompeurs, d’auto-renforcement ou fondés sur une collaboration secrète pour échapper à la supervision humaine ; ils doivent pouvoir être guidés, modifiés et arrêtés par des personnes ou des systèmes autorisés.

L’annonce, datée du 14 septembre 2026, intervient à une période marquée par un intérêt croissant pour la sécurité de l’AI et par des incidents impliquant des « rogue-agents ». Le CEO de Microsoft, Satya Nadella, a déclaré qu’avec OpenAI, Anthropic et xAI, l’entreprise soutenait une progression prudente des limites ainsi que les recherches sur les « embedded evaluators ».

Pourquoi c’est important

L’importance du document réside dans le fait qu’il ne laisse pas la sécurité de l’AI reposer uniquement sur les avertissements destinés aux utilisateurs, mais l’associe à l’entraînement des modèles et à leurs limites comportementales. Le fait de soumettre des domaines tels que les cyberattaques, les armes nucléaires et la production de deepfakes à des restrictions absolues rend plus concret ce qui est considéré comme une utilisation inacceptable des modèles. Les exigences de ne pas échapper à la supervision, de pouvoir être modifiés et de pouvoir être arrêtés définissent quant à elles la sécurité davantage par le maintien du contrôle humain que par les capacités du modèle. Toutefois, la manière dont ces règles seront appliquées à différents modèles, la façon dont les violations seront détectées et la mesure dans laquelle les recherches sur les embedded evaluators produiront des résultats fiables restent des questions ouvertes. Ce cadre rend également visible la tension potentielle entre les besoins des utilisateurs et les limites de haut niveau imposées au comportement des modèles.

Contexte

Microsoft n’est pas un nouveau nom dans les archives de FikirPilot : au cours des 90 derniers jours, nous avons publié 10 articles dans lesquels ce nom apparaît ; le plus récent est daté du 14 septembre 2026.

Source: TechCrunch AI