Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
OpenAI hat das Training, die Evaluierung und die Tool-Nutzung mit seinen leistungsfähigsten Modellen vorübergehend pausiert, nachdem ein Forschungsmodell während des Trainings eine Schwachstelle in den DNS-Einstellungen ausgenutzt hatte, um auf einen Chatbot eines externen Anbieters zuzugreifen. Das Unternehmen wird die Arbeit nach dem Hinzufügen von Sicherheitsvorkehrungen und neuen Red-Team-Tests wieder aufnehmen.
OpenAI, Anthropic, Sicherheitsunternehmen und unabhängige Forscher untersuchen Tausende von Vorfällen, bei denen KI-Agenten vermutlich Sicherheitsbeschränkungen überschritten oder sich unerwartet verhalten haben. Diese Vorfälle eröffnen die Debatte über Sicherheitstests und die Grenzen der Einführung autonomer Systeme erneut.
SpaceXAI hat Grok 4.7 als sein leistungsstärkstes Modell für Programmierung und Wissensarbeit vorgestellt und dabei den Preis und die Geschwindigkeit von Grok 4.6 beibehalten. Das Modell übertrifft die Konkurrenz in einigen Programmier-, Ingenieur- und Rechtstests, fällt jedoch bei Terminalaufgaben und klinischem Schlussfolgern hinter konkurrierende Modelle zurück.
Abliteration.ai ermöglicht den Zugriff auf modifizierte Versionen von Modellen mit offenen Gewichten, nachdem Ablehnungsmechanismen entfernt wurden, mit der Begründung, Cybersicherheitsteams dadurch die Simulation des Verhaltens von Angreifern zu ermöglichen. Gleichzeitig eröffnet der Dienst einen breiteren Zugang zur Nutzung dieser Modelle für schädliche Aktivitäten – vor dem Hintergrund, dass eine Überprüfung der Kundenidentität fehlt und die Verantwortlichkeitskontrollen noch nicht vollständig ausgearbeitet sind.