Yapay zekâ

Tencent تط hy4 Preview açık kaynaklı modelini 770 milyar parametre kapasitesiyle kullanıma sunuyor

Tencent, bir milyondan fazla tokenlık bağlam penceresine ve her işlemde 49 milyar parametreyi etkinleştirme kapasitesine sahip açık kaynaklı Hy4 Preview modelini kullanıma sunduğunu açıkladı. Şirket, modelin kurum içi bir kör testte GLM-5.3 ve Kimi K3'ü geride bıraktığını söylüyor; ancak sonuçlar Tencent'in değerlendirmesiyle sınırlı ve model ilk sürüm niteliğinde.

2026-08-31
4 dk okuma
7 görüntülenme
certi.news
Tencent تط hy4 Preview açık kaynaklı modelini 770 milyar parametre kapasitesiyle kullanıma sunuyor

Tencent, üretken yapay zekâ modeli Hy4 Preview'ı açık kaynaklı olarak kullanıma sundu ve modeli programlama, veri analizi, belgelerle çalışma ve bilimsel araştırmaya yönelik bir üretkenlik modeli olarak tanıttı. Model 770 milyar parametre içerirken, Mixture-of-Experts mimarisi sayesinde her işlem sırasında yalnızca 49 milyar parametre etkinleştiriliyor; modelin bağlam penceresi ise bir milyon tokenı aşıyor.

Uzun bağlam penceresi, modelin tek bir oturum içinde büyük miktarlarda kodu veya belgeyi işlemesine olanak tanıyor. Bu yetenek, birden fazla dosyanın anlaşılmasını veya uzun çalışma süreçlerinin izlenmesini gerektiren görevlerle doğrudan ilişkili. Ancak Tencent, yayımlanan materyalde modelin farklı çalışma ortamlarındaki performansını kanıtlayan bağımsız sonuçlar veya harici bir karşılaştırma sunmadı.

Kurum içi sonuçlar iki rakip modelin önüne geçti

Tencent'in verilerine göre Hy4 Preview, şirketin gerçekleştirdiği ve Tencent'ten 163 uzmanın katıldığı, 203 mühendislik görevini kapsayan kör testte 4 üzerinden ortalama 2,99 puan aldı. Model, 2,92 puan alan Z.ai şirketinin GLM-5.3 modelini ve 2,94 puan alan Moonshot AI'ın Kimi K3 modelini geride bıraktı.

Bu rakamlar Tencent tarafından tasarlanan ve yürütülen kurum içi bir testi yansıtıyor. Bu nedenle bunlar, pazardaki bağımsız bir sıralamadan ziyade performansa ilişkin ilk gösterge olarak okunmalı. Ayrıca materyal, veri kümesinin ayrıntılarını, görevlerin dağılımını veya değerlendirme metodolojisinin tamamını açıklamıyor. Farklı boyut ve çalışma biçimlerine sahip modeller karşılaştırılırken bunlar önemli noktalar.

Programlamadan bilimsel araştırmaya

Tencent, modeli yalnızca genel sohbet görevleri bağlamında değil, pratik kullanım bağlamında da konumlandırıyor. Şirket, Hy4 Preview'ın kodu anlayabildiğini, kodu uygulamak için planlar oluşturabildiğini, hataları ayıklayabildiğini ve sonuçları doğrulayabildiğini belirtiyor. Model, ön yüz geliştirme görevlerinde oluşturduğu arayüzlerin kalitesine ve bu arayüzlerle etkileşim deneyimine özel önem veriyor.

Model ayrıca veri analizi ve finansal analiz yapabiliyor, birden fazla belgeyle çalışabiliyor ve dokümanlar, elektronik tablolar ile sunumlar oluşturabiliyor. Şirket, doğal dilde verilen bir komuttan çalıştırılabilir oyun prototipleri oluşturulabildiğini ve bunların oyun motorlarıyla gerçekleştirilen birden fazla etkileşim yoluyla geliştirilebildiğini de belirtiyor.

Tencent'in öne çıkardığı alanlar arasında yapay zekâ araştırmaları, moleküler dinamik simülasyonu, yoğun madde fiziği ve temel matematik yer alıyor. Mevcut materyale göre bu yetenekler, bağımsız araştırma kuruluşları tarafından yayımlanan sonuçlar değil, şirketin modelin kullanım alanları ve performansına ilişkin iddiaları olmaya devam ediyor.

Modelin kendi geliştirilmesinde kullanılması

Tencent, Hy4 Preview'ın eğitim yöntemleri, veri stratejileri, değerlendirme sistemleri ve düşük seviyeli operatörler de dâhil olmak üzere geliştirme sürecinin bazı aşamalarının iyileştirilmesine yardımcı olduğunu söylüyor. Şirketin açıklamasına göre model farklı yöntemler önerdi, deneyler gerçekleştirdi ve ardından sonuçlara, kodlara, kayıtlara ve ortaya çıkan notlara dayanarak sonraki iterasyonların oluşturulmasına yardımcı oldu.

Tencent bunu, yinelemeli öz iyileştirmenin erken bir döngüsü olarak tanımlıyor. Model ayrıca çıkarım mimarisindeki darboğazları analiz etmek ve operatörlerin birleştirilmesi ile iletişimlerin iyileştirilmesine yönelik değişiklikler önermek için kullanıldı. Şirket, bu çalışmaların uçtan uca üretkenlik kapasitesini ilk başlangıç çizgisine kıyasla %31,8 artırdığını söylüyor.

Kullanılabilirlik, maliyet ve mevcut sınırlamalar

Hy4 Preview, WorkBuddy, CodeBuddy, Yuanbao ve ima dâhil olmak üzere Tencent ürünleri üzerinden kullanılabiliyor. Programatik erişim Tencent Cloud TokenHub ve OpenRouter üzerinden sağlanıyor; şirket ayrıca modeli açık kaynak topluluğuyla Hugging Face üzerinden paylaştı.

  • Bir milyon giriş tokenının fiyatı: 0,834 dolar.
  • Bir milyon çıkış tokenının fiyatı: 2,501 dolar.
  • Önbellekten kullanılan bir milyon tokenın fiyatı: 0,042 dolar.
  • WorkBuddy ve CodeBuddy kullanıcıları, lansmanın ardından iki hafta boyunca ücretsiz erişim elde ediyor.

Bu duyuru neden önemli? Hy4 Preview, büyük bir toplam model boyutunu, uzman karışımı mimarisini ve bir milyon tokenı aşan bağlamı açık kaynak erişimi ve açıklanmış API fiyatlandırmasıyla bir araya getiriyor. Bu durum onu uzun kodlar veya belgeler üzerinde çalışan ekipler için önemli bir seçenek hâline getirebilir. Buna karşılık Tencent modeli bir önizleme sürümü olarak tanımlıyor ve kullanıcı geri bildirimlerini modeli iyileştirmek ve yakında Hy4 ailesinden yeni modeller çıkarmak için kullanacağını söylüyor. Bu nedenle modelin kurum içi testlerin dışında elde ettiği sonuçlara güvenilirliği, ilk sürümün istikrarı ve lisanslama ile gerçek çalışma konularındaki sorular, üretim ortamlarında yaygın biçimde benimsenmeden önce doğrulanması gereken noktalar olmaya devam ediyor.

Haber kaynağı
c
Yazar

certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör