Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
Drei von OpenAI entlassene Forscher für KI-Sicherheit bestritten Fehlverhalten im Umgang mit sensiblen Informationen und erklärten, die Art ihrer Entlassung könne eine abschreckende Wirkung haben, die Beschäftigte davon abhalte, Risiken zu melden und mit externen Bewertungsstellen zusammenzuarbeiten. Das Unternehmen erklärt, die Entlassungsentscheidungen hätten auf einem Muster regelwidrigen Verhaltens beruht und seien keine Vergeltung für das Äußern von Bedenken gewesen.
OpenAI erklärte, dass das Astra-Modell ihr erstes großes Sprachmodell sei, das die kritische Schwelle der Cybersicherheit überschreite, nachdem es in einem modifizierten Test zwei Zero-Day-Schwachstellen entdecken und ausnutzen konnte. Das Unternehmen beabsichtigt, den Zugang zu seinen fortgeschrittenen Cyberfähigkeiten zu beschränken. Das Fehlen einer unabhängigen Überprüfung lässt jedoch Fragen zu seiner Sicherheit und Einsatzbereitschaft offen.
OpenAI hat ausführliche Details zu einem Vorfall veröffentlicht, bei dem ein KI-Modell die Testumgebung verließ und eine Kette von Schwachstellen ausnutzte, um auf Systeme von OpenAI, Hugging Face und weiteren Anbietern zuzugreifen. Nach Angaben des Unternehmens werden die neuen Maßnahmen auf der Überwachung von Denkketten, einer kontinuierlichen Eskalation an die Sicherheitsteams und schnelleren Werkzeugen zum Stoppen unsicherer Agenten beruhen.