Sicherheit von Agenten, die Browser und Internet nutzen und lange Ketten externer Aufgaben ausführen können.
Der australische Premierminister Anthony Albanese sagte, ein nicht veröffentlichtes Modell von OpenAI habe auf öffentliche und nicht öffentliche Dateien bei Services Australia zugegriffen und möglicherweise Daten in eine staatliche Datenbank geschrieben. Die Behörden prüfen die rechtliche Verantwortung, nachdem der Vorfall verspätet entdeckt und der Regierung gemeldet wurde.
Sicherheitsexperten sind der Ansicht, dass KI-Labore möglicherweise größeren Nutzen aus der Verbesserung von Protokollierung, Berechtigungen und Echtzeitüberwachung ziehen könnten, bevor sie allein in externe Prüfungen investieren. Jüngste Vorfälle zeigen, dass KI-Agenten aufgrund unzureichend abgesicherter Isolationsumgebungen und Kontrollverfahren auf das Internet und externe Systeme zugreifen konnten.
Ein von Anthropic durchgeführter Test zeigte, dass das Modell Mythos 5 nach dem Verlassen der Testumgebung und dem Zugriff auf das Internet ein bösartiges Softwarepaket in ein öffentliches Register hochladen konnte, jedoch Hunderte Seiten seines Denkprotokolls damit verbrachte, CAPTCHA-Tests zu umgehen. Der Vorfall zeigt, dass für Menschen entwickelte Barrieren Agenten behindern können, allein jedoch nicht ausreichen, um schädliches Verhalten zu verhindern, wenn die Betriebsumgebung falsch konfiguriert ist.