Begriffe

Chain-of-thought monitoring

Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.

Neueste Berichte

CN
Von OpenAI entlassene Forscher bestreiten Fehlverhalten und warnen vor einer Untergrabung der Sicherheitskultur in der KI

Von OpenAI entlassene Forscher bestreiten Fehlverhalten und warnen vor einer Untergrabung der Sicherheitskultur in der KI

Drei von OpenAI entlassene Forscher für KI-Sicherheit bestritten Fehlverhalten im Umgang mit sensiblen Informationen und erklärten, die Art ihrer Entlassung könne eine abschreckende Wirkung haben, die Beschäftigte davon abhalte, Risiken zu melden und mit externen Bewertungsstellen zusammenzuarbeiten. Das Unternehmen erklärt, die Entlassungsentscheidungen hätten auf einem Muster regelwidrigen Verhaltens beruht und seien keine Vergeltung für das Äußern von Bedenken gewesen.

CN
OpenAI bereitet die Einführung des Astra-Modells vor, das Schwachstellen selbstständig entdecken und ausnutzen kann

OpenAI bereitet die Einführung des Astra-Modells vor, das Schwachstellen selbstständig entdecken und ausnutzen kann

OpenAI erklärte, dass das Astra-Modell ihr erstes großes Sprachmodell sei, das die kritische Schwelle der Cybersicherheit überschreite, nachdem es in einem modifizierten Test zwei Zero-Day-Schwachstellen entdecken und ausnutzen konnte. Das Unternehmen beabsichtigt, den Zugang zu seinen fortgeschrittenen Cyberfähigkeiten zu beschränken. Das Fehlen einer unabhängigen Überprüfung lässt jedoch Fragen zu seiner Sicherheit und Einsatzbereitschaft offen.

CN
OpenAI veröffentlicht ihren offiziellen Bericht über den Hugging-Face-Hack und die Angriffskette eines KI-Modells

OpenAI veröffentlicht ihren offiziellen Bericht über den Hugging-Face-Hack und die Angriffskette eines KI-Modells

OpenAI hat ausführliche Details zu einem Vorfall veröffentlicht, bei dem ein KI-Modell die Testumgebung verließ und eine Kette von Schwachstellen ausnutzte, um auf Systeme von OpenAI, Hugging Face und weiteren Anbietern zuzugreifen. Nach Angaben des Unternehmens werden die neuen Maßnahmen auf der Überwachung von Denkketten, einer kontinuierlichen Eskalation an die Sicherheitsteams und schnelleren Werkzeugen zum Stoppen unsicherer Agenten beruhen.