Anthropic gab die Verfügbarkeit der Modelle Claude Fable 5.1 und Claude Mythos 5.1 bekannt, mit einem Schwerpunkt auf Programmierung, informationsintensiven Aufgaben und langfristiger Problemlösung. Beide Modelle verwenden dieselbe grundlegende Architektur, doch Mythos 5.1 kommt mit flexibleren Sicherheitsbeschränkungen und ist nur für verifizierte Nutzer und Organisationen in den Bereichen Cybersicherheit und Lebenswissenschaften verfügbar.
Fable 5.1 richtet sich an den allgemeinen Einsatz, während Mythos 5.1 die auf spezialisierte Aufgaben ausgerichtete Version darstellt, die möglicherweise einen größeren Umfang an Tests oder technischen Abläufen erfordert. Anthropic zufolge behält das neue Modell die Preise für Eingabe- und Ausgabetokens von Fable 5 bei: 10 US-Dollar pro einer Million Eingabetokens und 50 US-Dollar pro einer Million Ausgabetokens über die API. Gleichzeitig senkte das Unternehmen den Preis für das Lesen von Tokens aus dem Cache um 75 % auf 0,25 US-Dollar pro einer Million Tokens.
Senkung der Kosten agentischer Aufgaben
Anthropic zufolge sparen Nutzer durch diese Änderungen bei typischen Arbeitslasten im Vergleich zu Fable 5 etwa 25 %, während die Einsparungen bei agentischen Aufgaben mit zahlreichen Tool-Aufrufen und langen Kontexten rund 45 % erreichen können. Das Unternehmen erklärt, dass Fable 5.1 bei niedrigen oder mittleren Stufen der Rechenleistung eine vergleichbare oder höhere Leistung als Fable 5 erzielen kann. In Claude Code arbeitet das Modell standardmäßig mit einer hohen Stufe, in Claude Cowork und Claude.ai mit einer mittleren Stufe.
Bessere Ergebnisse bei Programmierung und Forschung
Die von Anthropic vorgestellten Tests zeigten in einigen Bereichen deutliche Verbesserungen. Fable 5.1 erreichte im Test Terminal-Bench-Science 0.1 eine Quote von 52,6 %, verglichen mit 24,7 % für Fable 5. Im Programmierungstest Terminal-Bench 4.0 erzielte Fable 5.1 55,8 %, während Mythos 5.1 60,9 % erreichte; Fable 5 lag bei etwa 42 %.
Das Unternehmen nennt Beispiele für langfristige Aufgaben. Dazu gehört, dass Fable 5.1 einen seltenen Programmierfehler in den Systemen des Investmentunternehmens Millennium entdeckte, der ungefähr einmal pro einer Million Ausführungen auftrat. Außerdem nutzte das Modell Radarbilder, die von der Magellan-Mission der NASA gesammelt wurden, um eine hochauflösende Höhenkarte zu erstellen, die etwa ein Drittel der Venus bedeckt. Im Bereich der computergestützten Biologie half Mythos 5.1 bei der Optimierung von Grafikprozessoren für sieben quelloffene Deep-Learning-Modelle und beschleunigte einige Modelle um bis zu das 2,5-Fache.
Neue Beschränkungen gegen Modell-Destillation
Fable 5.1 umfasst Mechanismen zur Bekämpfung der Modell-Destillation, also des groß angelegten Sammelns von Ausgaben eines fortgeschrittenen Modells zum Training eines anderen Modells. Anthropic zufolge können solche Vorgänge auf Tausenden von Scheinaccounts beruhen, um die Fähigkeiten fortgeschrittener Modelle auf Systeme zu übertragen, die nicht dieselben Sicherheitskontrollen anwenden.
Nach der Änderung können neue Claude-API-Konten dem Nutzer nicht mehr erlauben, den bisherigen Gesprächskontext manuell zu verändern und gleichzeitig die früheren Denkschritte des Modells in einem mehrstufigen Gespräch beizubehalten. Anthropic zufolge schließt diese Maßnahme einen öffentlich dokumentierten Weg zur Modell-Destillation. Das Unternehmen hatte zuvor die Entdeckung von Vorgängen bekannt gegeben, an denen rund 24.000 Scheinaccounts und mehr als 1,6 Millionen Interaktionen mit Claude beteiligt waren, und sie mit DeepSeek, Moonshot AI und MiniMax in Verbindung gebracht. Die neue Beschränkung gilt derzeit nur für neue Konten und könnte mit künftigen Versionen auf alle Konten ausgeweitet werden.
Was ändert sich praktisch?
Der wichtigste Wert der Ankündigung beschränkt sich nicht auf die Namen der beiden Modelle, sondern verbindet eine Senkung der Nutzungskosten für agentische Aufgaben mit einer strengeren Kontrolle des Zugriffs auf den bisherigen Kontext. Dies könnte Entwicklern zugutekommen, die viele lang laufende Aufgaben mit zahlreichen Aufrufen verwalten, fügt aber zugleich eine Einschränkung für Methoden zum Testen oder Verwalten von Gesprächen über die API hinzu. Außerdem stammen die genannten Leistungswerte von Anthropic selbst; daher macht der Artikel nicht deutlich, inwieweit sie außerhalb der genannten Tests vergleichbar sind.
Fable 5.1 ist über die Claude-Plattform sowie über die Dienste Amazon Web Services, Google Cloud und Microsoft Azure und über die Claude API unter der Kennung claude-fable-5-1 verfügbar. Die Verfügbarkeit von Mythos 5.1 ist dagegen auf Nutzer aus den Bereichen Cybersicherheit und Lebenswissenschaften beschränkt, die das Cyber Verification Program oder das Life Sciences Verification Program bestehen. Das Programm für Lebenswissenschaften wurde in Zusammenarbeit mit der US-Regierung entwickelt, während das für die Prüfung von Codebasen auf Schwachstellen bestimmte Produkt Claude Security nun von Mythos 5.1 unterstützt wird.