Google und Google DeepMind haben am 17. September 2026 das „DeepMind Institute“ ins Leben gerufen, um die Debatte über künstliche allgemeine Intelligenz (AGI) auszuweiten und die Unterschiede zwischen den Positionen von Google, Google DeepMind und Forschern weltweit sichtbar zu machen. Geleitet wird das Institut von Shane Legg, dem Mitbegründer von DeepMind, gemeinsam mit James Manyika, einem leitenden Google-Manager, und Demis Hassabis, dem Leiter von Google DeepMind. Legg übernimmt außerdem die Rolle des geschäftsführenden Redakteurs.
Das Institut versteht sich als Raum zur Darstellung von Ansichten, die nicht immer übereinstimmen müssen und sich mit dem Auftauchen neuer Daten und Informationen in einem sich schnell entwickelnden Bereich verändern können. Dieser Schritt erfolgt zu einem Zeitpunkt, an dem sich die Debatte über die Sicherheit künstlicher Intelligenz von allgemeinen Stellungnahmen hin zu konkreteren Vorschlägen zur Offenlegung, externen Prüfung und Verlangsamung der Entwicklung fortschrittlicher Modelle bewegt, falls diese nicht von geeigneten Sicherheitsvorkehrungen begleitet wird.
Vier Perspektiven auf die Debatte
Die erste Sammlung des Instituts umfasst vier Artikel. Sie behandeln politische Maßnahmen im Umgang mit möglichen wirtschaftlichen Verwerfungen, die durch künstliche allgemeine Intelligenz verursacht werden könnten, die Bewahrung der menschlichen Verständlichkeit der Schlussfolgerungen von Modellen, Grundsätze zur Förderung menschlichen Wohlstands sowie einen Rahmen zur Bewertung führender Modelle der künstlichen Intelligenz.
In einem der Artikel warnen die DeepMind-Sicherheitsforscher Rohin Shah und Anca Dragan davor, dass eine abnehmende Fähigkeit der Forscher, die Schlussfolgerungsschritte eines Modells einzusehen und zu überprüfen, kein zwangsläufiges Ergebnis ist. Da sich Architekturen entwickeln, die die leistungsfähigsten Modelle schwerer überwachbar machen, fordern die beiden Forscher Entwickler und Regulierungsbehörden auf, die damit verbundenen Sicherheitsabwägungen direkt zu berücksichtigen.
Zu den von ihnen vorgeschlagenen Optionen gehören die Begrenzung der „opaquen seriellen Tiefe“ (opaque serial depth), also des Umfangs der sequenziellen Berechnungen, die ein Modell durchführen kann, ohne einen lesbaren Schlussfolgerungspfad zu erzeugen, oder die Verpflichtung der Entwickler, nachzuweisen, dass weniger transparente Systeme weiterhin im gleichen Maß überwachbar sind.
Ein US-amerikanischer Rahmen zur Bewertung von Modellen
In einem weiteren Artikel schlägt Hassabis die Einrichtung einer von den Vereinigten Staaten geführten Behörde für Standards für fortgeschrittene künstliche Intelligenz vor, die die am weitesten entwickelten Modelle bewerten soll. Nach dem vorgestellten Konzept würden Entwickler ihre Modelle bis zu 30 Tage vor der Veröffentlichung freiwillig zur Prüfung einreichen. Später soll das Bestehen der Tests zur Voraussetzung für die Veröffentlichung führender Modelle innerhalb der Vereinigten Staaten werden, sofern sich das Bewertungssystem als wirksam erweist.
Die Behörde würde die Bewertungstests zunächst in Abstimmung mit Unternehmen der künstlichen Intelligenz entwickeln und anschließend zu unabhängigen Tests übergehen, die nicht im Voraus angekündigt werden, oder zu dem, was der Rahmen als „zurückgehaltene Tests“ (held-out tests) bezeichnet. Dadurch soll verhindert werden, dass Labore ihre Modelle gezielt auf zuvor bekannte Tests optimieren. Der Vorschlag erwähnt außerdem die Möglichkeit, die Maßnahmen schrittweise zu verschärfen und bei entsprechender Gefahrenlage bis zu einer koordinierten Verlangsamung zwischen den Entwicklern fortschrittlicher Modelle zu gehen.
Warum ist diese Nachricht wichtig?
Die praktische Bedeutung der Initiative beschränkt sich nicht auf die Schaffung einer neuen Veröffentlichungsplattform, sondern liegt auch darin, dass sie die Diskussionen von Google und Google DeepMind über Fragen zusammenführt, die die Art und Weise der Entwicklung und Bewertung von Modellen beeinflussen könnten. Die Artikel behandeln Transparenz, Überwachbarkeit und unabhängige Prüfung als operative Fragen und nicht nur als allgemeine Grundsätze.
Das Institut ist jedoch keine unabhängige Regulierungsbehörde, und der vorgeschlagene Bewertungsrahmen beginnt freiwillig und ist noch nicht zu einer verbindlichen Richtlinie geworden. Fragen zur Unabhängigkeit der Behörde, zur Art der unangekündigten Tests und zu den Kriterien für die Feststellung, wann eine Verlangsamung der Entwicklung erforderlich ist, bleiben im Rahmen der vorliegenden Informationen offen.