Yapay zekâ

JetBrains, programlama ajanları için hızlı açık model olarak Mellum2.1’i piyasaya sürüyor

JetBrains, Apache 2.0 lisansıyla açık Mellum2.1 modelini piyasaya sürdü. Model, programlama ajanlarını ve alt ajanları yerel olarak veya kullanıcının kendi altyapısında çalıştırmaya odaklanıyor. Sürüm, gerçek yazılım ortamlarında pekiştirmeli öğrenmeyle gerçekleştirilen eğitime dayanıyor ve kod depolarıyla çalışma ile çıkarım hızında önemli iyileştirmeler sunuyor.

2026-10-08
3 dk okuma
817 görüntülenme
certi.news Editorial Team
JetBrains, programlama ajanları için hızlı açık model olarak Mellum2.1’i piyasaya sürüyor

JetBrains, kullanıcı cihazlarında veya kendi altyapılarında hızlı görevler yürütmesi gereken programlama ajanları ve alt ajanlar için tasarlanmış açık bir model olan Mellum2.1’i piyasaya sürdüğünü duyurdu. Sürüm, 12 milyar parametreli Mellum2 modelinin bir sonraki neslini temsil ediyor; 2,5 milyar etkin parametre kullanan aynı uzman karışımı mimarisini koruyor ve Apache 2.0 lisansıyla sunuluyor.

Temel iyileştirme mimarinin değiştirilmesinden değil, eğitim sonrası aşamadan kaynaklanıyor. JetBrains, pekiştirmeli öğrenmeye daha fazla ağırlık verdiğini ve modeli kod depolarındaki gerçek çalışmaya daha yakın görevler üzerinde eğitmek amacıyla binlerce yazılım ortamında milyonlarca yalıtılmış çalıştırma gerçekleştirdiğini söylüyor.

Yanıttan depo içinde çalışmaya

JetBrains’e göre Mellum2 hızlıydı, ancak yazılım depolarını gereken düzeyde ele alamıyordu. Mellum2.1 ise kod tabanını keşfedebiliyor, dosyaları değiştirebiliyor ve yaptığı değişiklikleri inceleyebiliyor. Bu sayede başarısız bir testin kök nedenini belirleme, ardından düzeltme hazırlayıp bunu doğrulama gibi bir yazılım ajanı planının farklı aşamalarını yürütmek için kullanılabiliyor.

Daha sıkı veriler ve ortamlarla eğitim

Yeni eğitim görevleri matematik, rekabetçi programlama, bilim, araç kullanımı ve yazılım mühendisliğini kapsıyordu. JetBrains, açık verileri şirket içinde geliştirilen görevlerle birleştirdi; ancak açık verilerin bozuk testler, doğrulanamayan yanıtlar veya çok kolay ya da imkânsız problemler içerebileceğine dikkat çekti. Bu nedenle kaynaklar eğitime dahil edilmeden önce filtrelendi.

Şirket ayrıca binlerce ortamı dahili olarak çalıştırabilen pekiştirmeli öğrenme ortamları oluşturmaya odaklandı. Bu, eğitim sırasında milyonlarca yalıtılmış deney gerçekleştirilmesini sağladı.

Performans ve hızda iyileşme

JetBrains, Mellum2.1’i önceki sürümün yanı sıra Qwen3.5-9B ve Gemma 4 E4B modelleriyle ortak bir değerlendirme ayarı kullanarak karşılaştırdı. En büyük iyileşme aracı programlamada görülürken programlama, rekabetçi programlama, matematik, araç çağırma ve genel bilgide de ek kazanımlar elde edildi.

Eğitim sonrası aşama mimariyi değiştirmediği için model Mellum2’nin hızını korudu; çoklu belirteç tahmini (MTP) ise çıkarımı hızlandırmaya katkıda bulunuyor. JetBrains, yüksek yük altında modelin Qwen3.5-9B’nin hizmet verdiği belirteç sayısının yaklaşık iki katına hizmet verdiğini ve MTP’nin tek bir istekte modeli yaklaşık 1,6 kat daha hızlı hale getirdiğini söylüyor.

Pratikte ne değişiyor?

Mellum2.1, geliştirme ekiplerine programlama ajanları veya alt ajanlar oluşturmak için açık ve kendi kendine çalıştırılabilir bir seçenek sunuyor; kod ve veriler işletmeci kuruluşun kontrolünde kalıyor. Ancak aktarılan rakamlar JetBrains’in karşılaştırmalı testlerini yansıtıyor ve içerik, donanım gereksinimleri veya gerçek projelerdeki performans sınırları hakkında bağımsız ayrıntılar içermiyor.

Model şu anda Hugging Face’te mevcut. llama.cpp, Ollama ve LM Studio için GGUF sürümlerinin yanı sıra vLLM üzerinden spekülatif kod çözmede kullanılan MTP başlığının ise daha sonra sunulması planlanıyor.

Haber kaynağı
JetBrains Blog
Özgün kaynağı aç ↗
c
Yazar

certi.news Editorial Team

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör