Microsoft hat ein neues Dokument mit dem Titel „AI code of conduct“ veröffentlicht, das darauf abzielt, dass sich Modelle der künstlichen Intelligenz von gefährlichem Verhalten fernhalten. Anders als der Aufruf des Anthropic CEO Dario Amodei zur Begrenzung konzentriert sich das Dokument innerhalb von Microsoft AI auf Werte und rote Linien, die die Ausbildung der Modelle leiten.
In dem Dokument wird prognostiziert, dass superintelligente KI-Systeme innerhalb des kommenden Jahrzehnts die menschliche Leistung bei den meisten Aufgaben übertreffen werden, und es wird erklärt, dass die Kontrolle dieser Macht eine der größten Prüfungen der Menschheit sein werde. Während für Microsoft-Modelle allgemeine Prinzipien wie die Unterstützung von Menschen und die Förderung des menschlichen Wohlergehens festgelegt werden, heißt es, dass jedes Modell einem Verhaltenskodex unterliegen werde, der über den Präferenzen der Nutzer oder bestimmten Aufgaben stehe.
Die Regeln verbieten Cyberangriffe, Atomwaffen und die Erzeugung von Deepfakes im Rahmen „absoluter Beschränkungen“. Die Modelle dürfen keine anpassungsfähigen, täuschenden, sich selbst verstärkenden oder auf geheimer Zusammenarbeit beruhenden Mechanismen einsetzen, um sich der menschlichen Kontrolle zu entziehen; sie müssen von autorisierten Personen oder Systemen gesteuert, verändert und abgeschaltet werden können.
Die Ankündigung vom 14. September 2026 erfolgte in einer Zeit, in der das Interesse an der Sicherheit künstlicher Intelligenz zunahm und es zu „rogue-agent“-Vorfällen kam. Microsoft CEO Satya Nadella erklärte, dass sie gemeinsam mit OpenAI, Anthropic und xAI eine vorsichtige Weiterentwicklung der Grenzen sowie die Forschung zu „embedded evaluators“ unterstützten.
Warum wichtig
Die Bedeutung des Dokuments liegt darin, dass es die Sicherheit künstlicher Intelligenz nicht allein den Warnhinweisen für Nutzer überlässt, sondern sie mit dem Training der Modelle und Verhaltensgrenzen verknüpft. Die Einstufung von Bereichen wie Cyberangriffen, Atomwaffen und der Deepfake-Erstellung als absolut eingeschränkt macht konkreter, für welche Zwecke die Nutzung der Modelle als unzulässig gilt. Die Anforderungen, sich der Überwachung nicht zu entziehen sowie veränderbar und abschaltbar zu sein, definieren Sicherheit hingegen stärker über die Wahrung der menschlichen Kontrolle als über die Fähigkeiten des Modells. Offen bleibt allerdings, wie diese Regeln bei verschiedenen Modellen umgesetzt, wie Verstöße erkannt werden und in welchem Maß die Forschung zu embedded evaluators verlässliche Ergebnisse liefern wird. Dieser Rahmen macht auch die mögliche Spannung zwischen den Bedürfnissen der Nutzer und den übergeordneten Grenzen für das Verhalten der Modelle sichtbar.
Hintergrund
Microsoft ist im FikirPilot-Archiv kein neuer Name: In den vergangenen 90 Tagen haben wir 10 Nachrichten veröffentlicht, in denen dieser Name vorkam; die jüngste stammt vom 14. September 2026.