Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
Anthropic erklärte, dass fünf mit chinesischen KI-Unternehmen verbundene Kampagnen versucht hätten, fortgeschrittene Fähigkeiten aus dem Claude-Modell über nahezu 200 Millionen Interaktionen zu extrahieren. Eine Kampagne wurde Alibaba und eine weitere Moonshot AI zugeschrieben. Nach Ansicht des Unternehmens könnten diese Methoden zur Erstellung von Trainingsdaten für konkurrierende Modelle genutzt werden, obwohl der Bericht die Vorwürfe des Unternehmens wiedergibt und der Artikel keine unabhängigen Belege dafür liefert.
Das Astra-Modell von OpenAI soll voraussichtlich die Technik der „rekurrenten Tiefe“ nutzen, bei der Anfragen in wiederholten Schleifen statt in der üblichen Abfolge verarbeitet werden. Dadurch könnten Inferenzspuren für Beobachter weniger deutlich erkennbar sein. Das Unternehmen erklärt, der Einsatz der Technik werde begrenzt sein, und bekräftigt sein Engagement für lesbare Gedankengänge. Forschende im Bereich der KI-Sicherheit warnen jedoch vor einer Ausweitung.