Microsoft publicó un nuevo documento de “AI code of conduct” cuyo objetivo es mantener a los modelos de inteligencia artificial alejados de comportamientos peligrosos. A diferencia del llamamiento a la limitación realizado por el CEO de Anthropic, Dario Amodei, el documento se centra en los valores y las líneas rojas que orientan el entrenamiento de modelos dentro de Microsoft AI.
El documento prevé que, en la próxima década, los sistemas de inteligencia artificial superinteligentes superarán el rendimiento humano en la mayoría de las tareas, y señala que controlar este poder será uno de los mayores desafíos de la humanidad. Mientras se establecen principios generales para los modelos de Microsoft, como apoyar a las personas y promover el bienestar humano, se afirma que cada modelo estará sujeto a un código de conducta que prevalecerá sobre las preferencias de los usuarios o las tareas específicas.
Las reglas prohíben los ciberataques, las armas nucleares y la producción de deepfakes dentro del ámbito de las “restricciones absolutas”. Los modelos no deben utilizar mecanismos adaptables, engañosos, de autoafianzamiento o basados en la cooperación encubierta para eludir la supervisión humana; además, deben poder ser dirigidos, modificados y apagados por personas o sistemas autorizados.
El anuncio, fechado el 14 de septiembre de 2026, se produjo en un periodo de creciente interés por la seguridad de la inteligencia artificial y de incidentes de “rogue-agent”. El CEO de Microsoft, Satya Nadella, declaró que, junto con OpenAI, Anthropic y xAI, apoyan el avance cuidadoso de los límites y la investigación sobre “embedded evaluators”.
Por qué es importante
La importancia del documento radica en que no deja la seguridad de la inteligencia artificial únicamente en manos de las advertencias a los usuarios, sino que la vincula con el entrenamiento de los modelos y los límites de su comportamiento. La inclusión de ámbitos como los ciberataques, las armas nucleares y la producción de deepfakes entre las restricciones absolutas hace más concreto qué usos de los modelos se consideran inaceptables. Los requisitos de no eludir la supervisión, poder ser modificados y poder apagarse definen la seguridad, más que a través de las capacidades del modelo, mediante la preservación del control humano. No obstante, siguen siendo preguntas abiertas cómo se aplicarán estas normas en distintos modelos, cómo se detectarán las infracciones y hasta qué punto las investigaciones sobre embedded evaluators producirán resultados fiables. Este marco también hace visible la posible tensión entre las necesidades de los usuarios y los límites de alto nivel impuestos al comportamiento de los modelos.
Antecedentes
Microsoft no es un nombre nuevo en el archivo de FikirPilot: en los últimos 90 días hemos publicado 10 noticias en las que aparece este nombre; la más reciente está fechada el 14 de septiembre de 2026.