En son haberleri, açıklamaları ve bağlantılı teknoloji hikâyelerini takip edin.
JetBrains, Apache 2.0 lisansıyla açık Mellum2.1 modelini piyasaya sürdü. Model, programlama ajanlarını ve alt ajanları yerel olarak veya kullanıcının kendi altyapısında çalıştırmaya odaklanıyor. Sürüm, gerçek yazılım ortamlarında pekiştirmeli öğrenmeyle gerçekleştirilen eğitime dayanıyor ve kod depolarıyla çalışma ile çıkarım hızında önemli iyileştirmeler sunuyor.
CNCF makalesine göre kurumsal yapay zekâ altyapısını işletmek, tek bir model veya küme dağıtmaktan ibaret değildir; kullanım, izolasyon ve maliyet dengesini gözeterek birden fazla ekip için ortak GPU birimlerinden oluşan bir filoyu yönetmeyi gerektirir. Makale; tedarik, tahsis, zamanlama, ağ, depolama, izleme ve faturalandırmayı kapsayan teknik katmanları ele alır.
Perplexity, ajanlarını kullanıcı cihazlarında yerel olarak çalıştırmak için Portable Computer platformunu piyasaya sürdü. Başlangıçta Nvidia DGX Spark ve en az 24 GB belleğe sahip RTX kartlı Linux bilgisayarlarda kullanılabilen sistem, modelleri, dosyaları ve işlemleri varsayılan olarak cihazda tutuyor; kullanıcıdan izin alınması hâlinde belirli bir adım daha güçlü bir bulut modeline yükseltilebiliyor.
CohereLabs, 2,4 milyar parametre içeren, görüntülerin özgün çözünürlüklerinde işlenmesini destekleyen ve Apache 2.0 lisansına sahip açık ağırlıklı bir görme ve dil modeli olan North-Micro-Vision-Instruct’ı piyasaya sürdü. Model; belge ve diyagram anlama, OCR ve özel ince ayar uygulamalarını hedefliyor. Ayrıca MLX-VLM için topluluk desteği ve NVIDIA grafik işlem birimlerinde dağıtım için bir AutoModel tarifi içeriyor.
VIDRAFT’ın AX-Ray projesi, Zyphra/Zamba2-1.2B ve nvidia/Nemotron-H-8B-Base-8K modellerinde nedensel sızıntı olarak nitelendirdiği kusurları belirleyip tekrarladıktan sonra, performans puanlarının ötesine geçen bir model değerlendirme yöntemi sunuyor. Çerçeve bu vakaları dağıtımı engelleyen kusurlar kapsamında ele alırken, bunları hizmet yolu veya API sorunlarından ayırıyor.
Liquid AI, LFM2.5-2.6B ve LFM2.5-2.6B-Base modellerini Hugging Face'te kullanıma sunduğunu açıkladı. Modeller, araç çağırma ve çok adımlı iş akışlarını yerel olarak destekliyor. Model, bilgisayarlarda ve telefonlarda hızlı ajanlar çalıştırmayı hedefliyor ve 2,5 gigabayttan az bellek tüketiyor.