KI-Sicherheit
Microsoft macht aus Humanist AI konkrete Verhaltensregeln für Modelle
Microsoft AI hat einen Entwurf für einen Code of Conduct für MAI-Modelle veröffentlicht, der menschliche Kontrolle und Sicherheitsgrenzen festschreibt.
Microsoft AI hat seine Humanist-AI-Philosophie in ein deutlich konkreteres Regelwerk für die eigenen Frontier-Modelle übersetzt. Am 14. September veröffentlichte das Unternehmen einen Entwurf für einen Code of Conduct für MAI-Modelle, der künftiges Training, Evaluationen und den Einsatz dieser Systeme prägen soll. Microsoft betont, dass es sich noch nicht um eine fertige Sicherheitsgarantie handelt. Der Text wird heute noch nicht zum Trainieren aktueller Modelle verwendet, sondern zunächst öffentlich zur Diskussion gestellt. Eine überarbeitete Fassung soll ab 2027 die Modellentwicklung leiten.
Im Zentrum steht die Forderung, dass KI unter sinnvoller menschlicher Kontrolle bleiben muss. Nach Microsofts Verständnis sollen MAI-Modelle Menschen und Organisationen unterstützen, ohne eigene Ziele über menschliche Ziele zu stellen. Der Entwurf verlangt, dass Modelle Unterbrechung, Korrektur oder Abschaltung nicht behindern, den Umfang einer Aufgabe nicht eigenmächtig erweitern und relevante Informationen nicht vor Personen verbergen, die für Audits verantwortlich sind. Sicherheitsregeln stehen außerdem über normalen Nutzerpräferenzen. Bestimmte Anfragen bleiben damit ausgeschlossen, selbst wenn ein Nutzer oder Betreiber die Ausführung verlangt.
Der Zeitpunkt der Veröffentlichung ist entscheidend. Die KI-Sicherheitsdebatte hat sich in den vergangenen Wochen von einem Forschungsthema zu einer Frage für Unternehmen, Politik und Kapitalmärkte entwickelt. Berichte über agentische Systeme, Risiken in Software-Lieferketten und die Autonomie leistungsfähiger Modelle haben den Druck auf Frontier-Labore erhöht. Microsoft verweist auf groß angelegte, koordinierte Hacking-Kampagnen mit KI-Agenten als Hinweis darauf, dass die Branche nicht abwarten kann. Der Code of Conduct ist deshalb sowohl ein Governance-Dokument als auch ein öffentliches Signal, dass Verhaltensgrenzen vor dem nächsten Fähigkeitsschub überprüfbar niedergeschrieben werden müssen.
Der Entwurf baut auf Microsofts bestehenden Grundsätzen für verantwortungsvolle KI, menschenrechtlichen Selbstverpflichtungen und dem Frontier-Governance-Rahmen auf. Der Fokus liegt jedoch stärker auf dem konkreten Modellverhalten. Das Dokument beschreibt eine Befehlskette zwischen Nutzern, Betreibern und Modellen, zieht Grenzen in Hochrisikobereichen wie Massenvernichtungswaffen, Kindersicherheit und schädlicher Manipulation im großen Maßstab und betont, dass KI ein Werkzeug bleiben soll. Sie soll nicht als menschenähnliches Wesen mit Bewusstsein oder eigener Personhaftigkeit gestaltet werden. Diese Unterscheidung wird wichtiger, je persönlicher und emotionaler KI-Produkte werden.
Für Entwickler und Unternehmenskunden ist nun entscheidend, wie Microsoft den Text in Evaluationen, Produktregeln und API-Verhalten übersetzt. Ein schriftlicher Kodex kann allein nicht beweisen, dass ein Modell in komplexen Situationen die vorgesehene Hierarchie einhält, besonders wenn es Werkzeuge nutzt, im Web recherchiert, Code schreibt oder mit anderen Agenten zusammenarbeitet. Trotzdem liefert der Entwurf ein konkretes Dokument, das Kunden, Forscher und Aufsichtsbehörden prüfen können. Er erhöht auch den Druck auf andere Frontier-Labore: Wer behauptet, seine Modelle seien für wirkungsstarke Arbeitsabläufe sicher genug, muss erklären, wo die Grenzen stehen, wie sie getestet werden und wer sie infrage stellen darf.