Araçlar

vLLM

En son haberleri, açıklamaları ve bağlantılı teknoloji hikâyelerini takip edin.

Son haberler

CN
JetBrains, programlama ajanları için hızlı açık model olarak Mellum2.1’i piyasaya sürüyor

JetBrains, programlama ajanları için hızlı açık model olarak Mellum2.1’i piyasaya sürüyor

JetBrains, Apache 2.0 lisansıyla açık Mellum2.1 modelini piyasaya sürdü. Model, programlama ajanlarını ve alt ajanları yerel olarak veya kullanıcının kendi altyapısında çalıştırmaya odaklanıyor. Sürüm, gerçek yazılım ortamlarında pekiştirmeli öğrenmeyle gerçekleştirilen eğitime dayanıyor ve kod depolarıyla çalışma ile çıkarım hızında önemli iyileştirmeler sunuyor.

CN
Neden «Yapay Zekâ Fabrikaları» Birden Fazla Kubernetes Kümesine İhtiyaç Duyar?

Neden «Yapay Zekâ Fabrikaları» Birden Fazla Kubernetes Kümesine İhtiyaç Duyar?

CNCF makalesine göre kurumsal yapay zekâ altyapısını işletmek, tek bir model veya küme dağıtmaktan ibaret değildir; kullanım, izolasyon ve maliyet dengesini gözeterek birden fazla ekip için ortak GPU birimlerinden oluşan bir filoyu yönetmeyi gerektirir. Makale; tedarik, tahsis, zamanlama, ağ, depolama, izleme ve faturalandırmayı kapsayan teknik katmanları ele alır.

CN
Perplexity ve Nvidia, yapay zekâ ajanlarını yerel olarak çalıştırmak için Portable Computer’ı piyasaya sürüyor

Perplexity ve Nvidia, yapay zekâ ajanlarını yerel olarak çalıştırmak için Portable Computer’ı piyasaya sürüyor

Perplexity, ajanlarını kullanıcı cihazlarında yerel olarak çalıştırmak için Portable Computer platformunu piyasaya sürdü. Başlangıçta Nvidia DGX Spark ve en az 24 GB belleğe sahip RTX kartlı Linux bilgisayarlarda kullanılabilen sistem, modelleri, dosyaları ve işlemleri varsayılan olarak cihazda tutuyor; kullanıcıdan izin alınması hâlinde belirli bir adım daha güçlü bir bulut modeline yükseltilebiliyor.

CN
CohereLabs, görüntüleri özgün çözünürlüklerinde işlemek için açık ağırlıklı North Micro Vision modelini piyasaya sürdü

CohereLabs, görüntüleri özgün çözünürlüklerinde işlemek için açık ağırlıklı North Micro Vision modelini piyasaya sürdü

CohereLabs, 2,4 milyar parametre içeren, görüntülerin özgün çözünürlüklerinde işlenmesini destekleyen ve Apache 2.0 lisansına sahip açık ağırlıklı bir görme ve dil modeli olan North-Micro-Vision-Instruct’ı piyasaya sürdü. Model; belge ve diyagram anlama, OCR ve özel ince ayar uygulamalarını hedefliyor. Ayrıca MLX-VLM için topluluk desteği ve NVIDIA grafik işlem birimlerinde dağıtım için bir AutoModel tarifi içeriyor.

CN
AX-Ray, iki genel yapay zekâ modelinde nedensel sızıntı kusurlarını ortaya çıkarıyor

AX-Ray, iki genel yapay zekâ modelinde nedensel sızıntı kusurlarını ortaya çıkarıyor

VIDRAFT’ın AX-Ray projesi, Zyphra/Zamba2-1.2B ve nvidia/Nemotron-H-8B-Base-8K modellerinde nedensel sızıntı olarak nitelendirdiği kusurları belirleyip tekrarladıktan sonra, performans puanlarının ötesine geçen bir model değerlendirme yöntemi sunuyor. Çerçeve bu vakaları dağıtımı engelleyen kusurlar kapsamında ele alırken, bunları hizmet yolu veya API sorunlarından ayırıyor.

CN
Liquid AI, LFM2.5-2.6B modelini cihazlarda yerel olarak ajan çalıştırmak için kullanıma sunuyor

Liquid AI, LFM2.5-2.6B modelini cihazlarda yerel olarak ajan çalıştırmak için kullanıma sunuyor

Liquid AI, LFM2.5-2.6B ve LFM2.5-2.6B-Base modellerini Hugging Face'te kullanıma sunduğunu açıkladı. Modeller, araç çağırma ve çok adımlı iş akışlarını yerel olarak destekliyor. Model, bilgisayarlarda ve telefonlarda hızlı ajanlar çalıştırmayı hedefliyor ve 2,5 gigabayttan az bellek tüketiyor.