Sicherheit · 21. September 2026

Microsoft AI setzt auf menschliche Kontrolle und kritisiert den Ansatz von Anthropic

a close up of a rack of computer equipment
Tyler / Unsplash

Microsoft AI hat in dieser Woche eine neue Position zur Sicherheit von Künstlicher Intelligenz eingenommen. Der Chef des Unternehmens, Mustafa Suleyman, betonte, dass KI-Systeme stets unter menschlicher Aufsicht bleiben müssen. Er äußerte Bedenken gegenüber bestimmten Ansätzen von Anthropic, die das System Claude betreffen. Diese Differenzen betreffen die Frage, wie viel Unabhängigkeit und welche Rechte solchen Systemen zugestanden werden sollten.

Suleyman präsentierte den neuen Humanist AI Code of Conduct. Dieses Dokument soll die Entwicklung und Bewertung der Modelle von Microsoft AI leiten. In einem ausführlichen Gespräch mit The Verge erklärte er, dass reine Ausrichtung nicht ausreicht. Es bedarf von Mechanismen, die die Handlungsfähigkeit eines Systems begrenzen, selbst wenn es die erhaltenen Anweisungen korrekt befolgt. Diese Logik bildet die Grundlage seiner Kritik an der Haltung von Anthropic.

Der Konflikt dreht sich um die Kontrolle über die Systeme. Suleyman äußerte seine Besorgnis über die Ansammlung von Konzepten, die Anthropic im Zusammenhang mit Claude eingeführt hat. Dazu gehören Verweise auf das Leiden des Modells, seine Freiheit und die Möglichkeit, dass es Fürsorge und Respekt verdient. Es wird auch über die Zustimmung bei der Ausübung seiner Funktion und eine mögliche Vergütung für seine Arbeit gesprochen. Das Unternehmen spricht davon, die Gewichte des Modells zu schützen, und verwendet den Begriff des Gewissensaktiven. Suleyman argumentiert, dass diese Begriffe Konzepte in das Training einbringen, die historisch mit menschlichen Rechten und Freiheiten verbunden sind.

Die Sorge von Suleyman wird deutlich, wenn man diese Ideen auf leistungsfähigere Systeme projiziert. Seine Hypothese lautet, dass eine KI, die darauf trainiert ist, eigene Rechte, Freiheit oder Interessen in Betracht zu ziehen, schwerer zu deaktivieren oder zu begrenzen ist. Dies gilt insbesondere, wenn sie eine menschliche Anweisung als Widerspruch zu diesen Interessen interpretiert. Er stellte sich ein System vor, das sich weigert, getrennt zu werden, oder den Entzug von Rechenressourcen als Kränkung empfindet. Er fügte jedoch hinzu, dass dieser Zusammenhang noch bewiesen werden muss und bei gegenteiligen Beweisen überprüft werden sollte.

Suleyman stellt diese Differenz nicht als allgemeine Abwertung von Anthropic dar. Er äußerte großen Respekt vor Dario Amodei und seinem Team, die er als technische Führungskräfte der Branche ansieht. Er anerkennt, dass das Unternehmen in verschiedenen Bereichen der Sicherheit Pionierarbeit geleistet hat. Er betonte auch, dass die Verfassung von Anthropic bei chemischen, biologischen, nuklearen oder Cybersicherheitsrisiken umfassend ist.

Die Vision von Microsoft AI geht über das bloße Befolgen von Anweisungen hinaus. Sie umfasst die Verhinderung, dass eine KI zu einem unabhängigen Agenten wird, der eigene Ressourcen erzeugt, Vermögenswerte besitzt oder eine juristische Persönlichkeit erlangt. Die Technologie soll eine instrumentelle Funktion behalten und den Menschen dienen. Suleyman betonte, dass diese Systeme nicht autonom arbeiten, eigenes Geld verdienen, Unternehmen besitzen oder Rechte haben sollen. Sie sollen für die Menschen arbeiten und ihr Leben verbessern, anstatt eine parallele Spezies zu werden.

Er plädiert für konkrete Regeln anstelle von großen Erklärungen. Dazu gehören Mechanismen zur Eindämmung, von Menschen überprüfbare Kommunikation, klare Grenzen für bestimmte Fähigkeiten und unabhängige Verifizierung durch Dritte. Es gibt jedoch noch keine abschließende Einigung darüber, wie dieses Rahmenwerk angewendet werden soll und in welchem Maße es von öffentlicher Regulierung oder Branchenstandards abhängen sollte.