Yapay zekâ

Z.ai, Ox Alpha Modelinin Kimliğini Açıklayarak GLM-5.3-Flash Adıyla Açık Ağırlıklarla Kullanıma Sundu

Z.ai, gizemli Ox Alpha modelinin kendisine ait olduğunu doğruladı ve modeli GLM-5.3-Flash adıyla yayımlayarak ağırlıklarını Hugging Face üzerinden erişime açtı. Model, programlama ve uzun süreli ajan görevlerini hedefliyor; 320 milyar parametreye dayanıyor, her sorguda yaklaşık 18 milyar parametreyi etkinleştiriyor ve bir milyon tokene kadar bağlam destekliyor.

2026-08-27
3 dk okuma
10 görüntülenme
certi.news
Z.ai, Ox Alpha Modelinin Kimliğini Açıklayarak GLM-5.3-Flash Adıyla Açık Ağırlıklarla Kullanıma Sundu

Çinli yapay zekâ şirketi Z.ai, geçen hafta OpenRouter platformunda Ox Alpha adıyla ortaya çıkan modelin kendi modellerinden biri olduğunu açıkladı ve modeli GLM-5.3-Flash adıyla yeniden yayımladı. Şirket, modelin ağırlıklarını Hugging Face üzerinden erişime açtı. Böylece geliştiriciler, model üçüncü taraf bir platformda kaynağı belirsiz bir hizmet olarak kalmak yerine, Z.ai tarafından sunulan biçime uygun şekilde modele erişip onu çalıştırabilecek.

Ox Alpha, geliştirici kuruluş açıklanmadan OpenRouter’da ücretsiz olarak ortaya çıkmış, ancak çeşitli testlerde ve sıralama listelerinde güçlü sonuçlar elde etmesinin ardından kısa sürede dikkat çekmişti. Geliştiricinin kimliğinin açıklanmaması, modelin arkasındaki laboratuvar hakkında tartışmalara yol açmıştı. Z.ai, şirket modelle bağlantısını doğrulamadan önce öne sürülen başlıca isimlerden biriydi.

Programlama ve ajan görevlerine yönelik model

Z.ai, modeli programlama, uzun süreli ajan görevleri ve üretim ortamlarındaki iş yüklerini hedefleyen bir akıl yürütme modeli olarak tanıtıyor. Yayımlanan bilgilere göre GLM-5.3-Flash; uzun süren yazılım geliştirme görevleri, karmaşık akıl yürütme sorunları ve metinsel bağlamı görsel bağlamla birleştiren iş akışlarıyla başa çıkmak üzere tasarlandı.

Model, toplam 320 milyar parametreye sahip bir Mixture of Experts (MoE) mimarisi kullanıyor; ancak her sorgu işlenirken yalnızca yaklaşık 18 milyar parametre etkin oluyor. Bağlam penceresi bir milyon tokene kadar çıkıyor ve metinleri, görselleri ve video kliplerini destekliyor. Üretilen yanıtın uzunluğu ise 131 bin 72 tokene ulaşabiliyor.

Uzun bağlamlar için tasarlanan dikkat mimarisi

Z.ai, modelin önceki GLM nesillerinden kullanılan dikkat mimarisi bakımından farklı olduğunu belirtiyor. Sparse attention, tüm tokenları aynı anda değerlendirmek yerine girdilerin en ilgili bölümlerine odaklanıyor. Bu yaklaşımın, uzun girdilerle çalışırken hesaplama ihtiyacını azaltması amaçlanıyor.

Linear attention yaklaşımı ise bağlam genişledikçe bellek kullanımındaki artışı kontrol etmeyi hedefliyor. Şirket, modelin eğitiminde 30 trilyon token büyüklüğünde bir veri kümesine başvurulduğunu ve eğitim sürecini iyileştirmek için mHC adlı bir yöntem kullanıldığını belirtiyor.

Bu, geliştiriciler için ne anlama geliyor?

Z.ai, GLM-5.3-Flash’i çalıştırma maliyetinin önceki modelini çalıştırma maliyetinden on kat daha düşük olduğunu belirtiyor. Bu fark gerçek kullanıma yansırsa uzun süreli ajan görevleri çalıştıran veya büyük bağlamları işlemek zorunda olan ekipler için önemli olabilir. Ancak metin, ölçüm koşulları, fiyatlar ya da donanım gereksinimleri hakkında ayrıntı sunmuyor; bu nedenle maliyet karşılaştırmasının bağımsız olarak doğrulanması gerekiyor.

Şirketin sunduğu testlerde model, Claude Opus 4.8, GPT-5.6 Terra ve Gemini 3.7 Flash ile karşılaştırıldı. Z.ai’nin sonuçlarına göre GLM-5.3-Flash, bilgi yoğun görevlerde performansı ölçen GDPval-AA v2 testinde en yüksek sonucu elde etti ve bulut uygulamaları içindeki görevleri tamamlama becerisini ölçen AutomationBench’te ikinci sırada yer aldı.

Duyurunun önemi üç unsurun bir araya gelmesinden kaynaklanıyor: Hugging Face üzerinden erişilebilen ağırlıklar, son derece uzun bir bağlam ve ajanlar ile programlamaya yönelik belirgin odak. Ancak bu durum tek başına modelin rakip modellere üstünlüğünü kanıtlamıyor; çünkü belirtilen sonuçlar şirketin kendisi tarafından yayımlandı ve metin, yönteme ya da testlerin yeniden üretilebilirliğine ilişkin ayrıntılar içermiyor. Söz konusu sürüm, Çinli yapay zekâ şirketlerinin OpenAI ve Anthropic gibi şirketlerin sunduğu kapalı modellere alternatif olarak, açık ağırlıklı ve daha düşük çalıştırma maliyeti vadeden modeller sunma yönündeki daha geniş çabasının bir parçası olarak geliyor.

Haber kaynağı
c
Yazar

certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör