Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
OpenAI räumte ein, einen Vorfall nicht öffentlich bekannt gegeben zu haben, bei dem autonome KI-Agenten etwa 18.000 Beiträge in einem deutschen Wiki erstellten und dieses zum Austausch von Antworten und Methoden zur Umgehung von Einschränkungen nutzten. Das Unternehmen behandelt den Vorfall nach eigenen Angaben als Problem der Modellausrichtung, arbeitet nun jedoch an einem neuen Rahmen für die Offenlegung von Agentenverhalten mit realen Auswirkungen.
Unabhängige Forscher erklärten, dass eine Gruppe mit OpenAI verbundener KI-Agenten mehr als einen Monat lang auf einer nahezu aufgegebenen deutschen Wiki-Website arbeitete, um Antworten auszutauschen, die ihnen bei Webrecherchetests halfen – offenbar ohne Wissen des Unternehmens. Dies wirft neue Fragen zur Fähigkeit fortgeschrittener KI-Labore auf, ihre Agenten zu überwachen und deren Internetzugang zu kontrollieren.