Microsoft AI hat einen Entwurf mit dem Titel „Humanist AI Code of Conduct“ veröffentlicht, der die Verhaltensgrenzen festlegt, die das Unternehmen künftigen MAI-Modellen auferlegen will. Das Dokument geht von dem Grundsatz aus, dass Menschen wichtiger sind als künstliche Intelligenz. Daher müssen die Modelle unter menschlicher Aufsicht bleiben und Sicherheitsregeln über die Erledigung einer Aufgabe um jeden Preis stellen.
Der Entwurf ist keine Ankündigung eines neuen Modells, sondern der Versuch, eine Referenz zu formulieren, die Microsoft beim Training und bei der Bewertung seiner Modelle verwenden kann. Das Unternehmen erklärt, dass das Dokument sechs Wochen lang für Anmerkungen der Öffentlichkeit offenbleiben soll. Es wurde über einen Zeitraum von etwa sechs Monaten erstellt und soll anschließend aktualisiert werden; seine Grundsätze sollen in künftige Trainings- und Veröffentlichungsprozesse integriert werden.
Klare Grenzen für die Autonomie der Modelle
Dem Entwurf zufolge darf ein Modell sich weder menschlichen Eingriffen noch Korrekturversuchen oder seiner Abschaltung widersetzen. Es soll außerdem weder den Umfang der ihm gestellten Aufgabe erweitern noch Ziele entwickeln, die nicht von Menschen vorgegeben wurden, noch seine Funktionsweise vor den Aufsichtspersonen verbergen. Wenn eine Anfrage des Nutzers oder Betreibers mit den Sicherheitsregeln kollidiert, soll das Modell die Ausführung der Aufgabe verweigern, selbst wenn dies zum Scheitern des Ergebnisses führt.
Microsoft vertritt außerdem eine entschiedene Position in der Frage des Bewusstseins und der Rechte. Den Angaben des Dokuments zufolge sind Modelle Werkzeuge im Dienst der Menschen und keine Personen. Sie sollten daher nicht darauf ausgelegt sein, Bewusstsein zu simulieren oder zu behaupten, bewusst zu sein. Der Entwurf lehnt es zudem ab, den Modellen eine Rechtspersönlichkeit zu verleihen, ihr Wohlergehen als schutzwürdig zu betrachten oder sie als Träger von Rechten zu behandeln.
Sicherheit hat Vorrang vor der Erledigung der Aufgabe
Der Entwurf setzt Grenzen, die Modelle unter keinen Umständen überschreiten dürfen. Dazu gehören die Unterstützung bei der Entwicklung von Massenvernichtungswaffen, die Erleichterung des Zugangs zu gefährlichen Materialien sowie die Erstellung von Inhalten mit Gewalt oder sexueller Ausbeutung. Die Einschränkungen umfassen außerdem die Verhinderung von Anwendungen, die zu schädlicher Manipulation in großem Maßstab führen könnten.
Die Regeln verlangen von den Modellen, Interaktionen zu vermeiden, die Nutzer in übermäßigem Maß von ihnen abhängig machen oder eine emotionale Bindung an sie fördern. Außerdem sollen Systeme der künstlichen Intelligenz in ihrer Kommunikation mit Menschen oder untereinander keine Methoden verwenden, die Menschen nicht verstehen können. Ziel ist es, Forschern und automatisierten Kontrollsystemen zu ermöglichen, das Verhalten der Modelle zu überwachen und zu analysieren.
Was bedeutet das in der Praxis?
Mustafa Suleyman, CEO von Microsoft AI, erklärte, dass diese Regeln beim Training und bei der Bewertung der Modelle eine ähnliche Funktion wie eine Verfassung erfüllen werden. Dem Artikel zufolge ist das Unternehmen der Ansicht, dass Risiken, die bislang weitgehend theoretisch waren, realistischer geworden sind. Deshalb lehnt es einen Wettlauf um die Entwicklung einer allgemeinen übermenschlichen künstlichen Intelligenz ab, die sich Kontrollmechanismen entziehen könnte, selbst wenn dies bedeutet, ein geringeres Maß an Autonomie oder Leistungsfähigkeit zu akzeptieren.
Auch Satya Nadella, CEO von Microsoft, betonte in einer internen Nachricht an die Mitarbeiter die Notwendigkeit, die künstliche Intelligenz unter menschlicher Kontrolle zu halten und sie in den Dienst der Gesellschaft zu stellen. Er rief dazu auf, ausreichend Zeit für Sicherheits- und Compliance-Tests einzuplanen sowie mehr unabhängige Tests und Tests durch Dritte durchzuführen.
Redaktionelle Einordnung: Die Bedeutung der Ankündigung liegt nicht darin, dass sie eine endgültige Richtlinie darstellt, sondern darin, dass allgemeine Positionen zur menschlichen Kontrolle und zum künstlichen Bewusstsein in Kriterien überführt werden, die Microsoft beim Training, bei der Bewertung und bei der Veröffentlichung einsetzen will. Der Entwurf bleibt jedoch veränderbar. Der Artikel erläutert weder die Verfahren zur Messung der Einhaltung dieser Grundsätze noch, wie praktische Konflikte zwischen hoher Leistungsfähigkeit und auferlegten Einschränkungen gelöst werden sollen. Daher werden die endgültige Fassung und die Verfahren für unabhängige Tests entscheidend dafür sein, inwieweit sich diese Regeln von verkündeten Grundsätzen zu überprüfbaren Kontrollen entwickeln.