Anthropic, programlama, yoğun bilgi gerektiren görevler ve uzun vadeli problem çözmeye odaklanan Claude Fable 5.1 ve Claude Mythos 5.1 modellerini kullanıma sunduğunu açıkladı. İki model aynı temel mimariyi kullanıyor, ancak Mythos 5.1 daha esnek güvenlik kısıtlamalarıyla geliyor ve yalnızca siber güvenlik ile yaşam bilimleri alanlarında doğrulanmış kullanıcılar ve kuruluşlar tarafından kullanılabiliyor.
Fable 5.1 genel kullanımı hedeflerken Mythos 5.1, daha geniş bir test veya teknik operasyon yelpazesine ihtiyaç duyabilecek uzmanlaşmış işletmelere yönelik sürüm olarak konumlandırılıyor. Anthropic, yeni modelin Fable 5’in giriş ve çıkış belirteçleri için geçerli fiyatlarını koruduğunu söylüyor: API üzerinden bir milyon giriş belirteci için 10 dolar ve bir milyon çıkış belirteci için 50 dolar. Buna karşılık şirket, önbellekten belirteç okuma fiyatını %75 düşürerek bir milyon belirteç başına 0,25 dolara indirdi.
Ajan görevlerinin maliyetini düşürme
Anthropic’e göre bu değişiklikler, kullanıcılara olağan iş yüklerinde Fable 5’e kıyasla yaklaşık %25 tasarruf sağlıyor; çok sayıda araç çağrısı ve uzun bağlam içeren ajan görevlerinde tasarruf yaklaşık %45’e ulaşabiliyor. Şirket, düşük veya orta düzeyde hesaplama gücü kullanıldığında Fable 5.1’in Fable 5’e benzer ya da daha yüksek performans gösterebildiğini belirtiyor. Model, Claude Code’da varsayılan olarak yüksek düzeyde, Claude Cowork ve Claude.ai’de ise orta düzeyde çalışıyor.
Programlama ve araştırmada daha iyi sonuçlar
Anthropic’in sunduğu testler bazı alanlarda belirgin iyileşmeler gösterdi. Fable 5.1, Terminal-Bench-Science 0.1 testinde %52,6 puan alırken Fable 5 %24,7’de kaldı. Programlama için Terminal-Bench 4.0 testinde Fable 5.1 %55,8, Mythos 5.1 ise %60,9 puan aldı; Fable 5’in sonucu yaklaşık %42 oldu.
Şirket, uzun vadeli görevlere örnek olarak Fable 5.1’in Millennium yatırım şirketinin sistemlerinde nadir görülen ve yaklaşık her bir milyon çalıştırmada bir ortaya çıkan bir yazılım hatasını keşfetmesini gösteriyor. Model ayrıca NASA’nın Magellan görevi tarafından toplanan radar görüntülerini kullanarak Venüs gezegeninin yaklaşık üçte birini kapsayan yüksek çözünürlüklü bir yükseklik haritası oluşturdu. Hesaplamalı biyoloji alanında Mythos 5.1, açık kaynaklı yedi derin öğrenme modeli için grafik işlem birimlerini optimize etmeye yardımcı oldu ve bazı modelleri 2,5 kata kadar hızlandırdı.
Model damıtmayla mücadele için yeni kısıtlamalar
Fable 5.1, gelişmiş bir modelin çıktılarının başka bir modeli eğitmek için geniş ölçekte toplanması süreci olan model damıtmayla mücadele mekanizmaları içeriyor. Anthropic, bu operasyonların gelişmiş modellerin yeteneklerini aynı güvenlik kontrollerini uygulamayan sistemlere aktarmak için binlerce sahte hesaba dayanabileceğini söylüyor.
Değişiklik uyarınca yeni Claude API hesapları, çok turlu bir görüşmede modelin önceki düşünme kayıtlarını korurken kullanıcının önceki görüşme bağlamını manuel olarak değiştirmesine izin vermeyecek. Anthropic, bu önlemin kamuya açık şekilde belgelenmiş model damıtma yöntemlerinden birini kapattığını belirtiyor. Şirket daha önce yaklaşık 24 bin sahte hesap ve Claude ile 1,6 milyondan fazla etkileşimi içeren operasyonlar keşfettiğini ve bunları DeepSeek, Moonshot AI ve MiniMax ile ilişkilendirdiğini açıklamıştı. Yeni kısıtlama şu anda yalnızca yeni hesaplara uygulanıyor; gelecekteki sürümlerle tüm hesaplara genişletilmesi olası.
Pratikte ne değişiyor?
Duyurunun en önemli değeri yalnızca iki modelin adlarıyla sınırlı değil; ajan kullanım maliyetlerinin düşürülmesiyle önceki bağlama erişim yöntemi üzerindeki kontrolün sıkılaştırılmasını bir araya getiriyor. Bu, çok sayıda çağrı içeren uzun görevleri yöneten geliştiricilere fayda sağlayabilir, ancak aynı zamanda API üzerinden görüşmeleri test etme veya yönetme yöntemlerine bir kısıtlama ekliyor. Ayrıca aktarılan performans sonuçları Anthropic’in kendi sunduğu rakamlar olduğundan, söz konusu sonuçların belirtilen testlerin dışında ne ölçüde karşılaştırılabilir olduğunu madde açıklamıyor.
Fable 5.1, Claude platformu ile Amazon Web Services, Google Cloud ve Microsoft Azure hizmetleri üzerinden ve claude-fable-5-1 tanımlayıcısıyla Claude API aracılığıyla kullanılabiliyor. Mythos 5.1’e erişim ise Cyber Verification Program veya Life Sciences Verification Program süreçlerini geçen siber güvenlik ve yaşam bilimleri kullanıcılarıyla sınırlı. Yaşam bilimleri programı ABD hükümetiyle iş birliği içinde geliştirildi; güvenlik açıklarını bulmak amacıyla kod depolarını incelemeye ayrılan Claude Security ürünü de Mythos 5.1 tarafından desteklenmeye başladı.