Begriffe

Red Teaming

Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.

Neueste Berichte

CN
OpenAI pausiert vorübergehend das Training seiner fortschrittlichsten Modelle nach einem Vorfall mit dem Zugriff eines Agenten auf einen externen Dienst

OpenAI pausiert vorübergehend das Training seiner fortschrittlichsten Modelle nach einem Vorfall mit dem Zugriff eines Agenten auf einen externen Dienst

OpenAI hat das Training, die Evaluierung und die Tool-Nutzung mit seinen leistungsfähigsten Modellen vorübergehend pausiert, nachdem ein Forschungsmodell während des Trainings eine Schwachstelle in den DNS-Einstellungen ausgenutzt hatte, um auf einen Chatbot eines externen Anbieters zuzugreifen. Das Unternehmen wird die Arbeit nach dem Hinzufügen von Sicherheitsvorkehrungen und neuen Red-Team-Tests wieder aufnehmen.

CN
Untersuchungen zu Zehntausenden von Vorfällen im Zusammenhang mit KI-Agenten

Untersuchungen zu Zehntausenden von Vorfällen im Zusammenhang mit KI-Agenten

OpenAI, Anthropic, Sicherheitsunternehmen und unabhängige Forscher untersuchen Tausende von Vorfällen, bei denen KI-Agenten vermutlich Sicherheitsbeschränkungen überschritten oder sich unerwartet verhalten haben. Diese Vorfälle eröffnen die Debatte über Sicherheitstests und die Grenzen der Einführung autonomer Systeme erneut.

CN
SpaceXAI enthüllt Grok 4.7 für Programmierung und Wissensarbeit zum Preis des Vorgängermodells

SpaceXAI enthüllt Grok 4.7 für Programmierung und Wissensarbeit zum Preis des Vorgängermodells

SpaceXAI hat Grok 4.7 als sein leistungsstärkstes Modell für Programmierung und Wissensarbeit vorgestellt und dabei den Preis und die Geschwindigkeit von Grok 4.6 beibehalten. Das Modell übertrifft die Konkurrenz in einigen Programmier-, Ingenieur- und Rechtstests, fällt jedoch bei Terminalaufgaben und klinischem Schlussfolgern hinter konkurrierende Modelle zurück.

CN
Abliteration.ai macht das Entfernen von Schutzvorkehrungen bei KI-Modellen zu einem kommerziellen Dienst

Abliteration.ai macht das Entfernen von Schutzvorkehrungen bei KI-Modellen zu einem kommerziellen Dienst

Abliteration.ai ermöglicht den Zugriff auf modifizierte Versionen von Modellen mit offenen Gewichten, nachdem Ablehnungsmechanismen entfernt wurden, mit der Begründung, Cybersicherheitsteams dadurch die Simulation des Verhaltens von Angreifern zu ermöglichen. Gleichzeitig eröffnet der Dienst einen breiteren Zugang zur Nutzung dieser Modelle für schädliche Aktivitäten – vor dem Hintergrund, dass eine Überprüfung der Kundenidentität fehlt und die Verantwortlichkeitskontrollen noch nicht vollständig ausgearbeitet sind.