Siber güvenlik

Abliteration.ai, Yapay Zekâ Modellerinin Engellerini Kaldırmayı Ticari Bir Hizmete Dönüştürüyor

Abliteration.ai, siber güvenlik ekiplerinin saldırganların davranışlarını taklit etmesini sağlama iddiasıyla, ret mekanizmaları kaldırılmış açık ağırlıklı modellerin değiştirilmiş sürümlerine erişim sunuyor. Ancak hizmet, müşteri kimliğini doğrulama mekanizmasının bulunmaması ve sorumluluk kontrollerinin tamamlanmamış olması nedeniyle bu modellerin zararlı faaliyetlerde kullanılmasının önünü de aynı anda açıyor.

2026-09-03
4 dk okuma
3 görüntülenme
فريق تحرير certi.news
Abliteration.ai, Yapay Zekâ Modellerinin Engellerini Kaldırmayı Ticari Bir Hizmete Dönüştürüyor

Açık ağırlıklı yapay zekâ modellerindeki güvenlik engellerinin kaldırılması, Abliteration.ai şirketinin gelişmiş modellerin değiştirilmiş sürümlerini barındıran ve bunların tarayıcı üzerinden ya da API aracılığıyla kullanılmasına olanak tanıyan bir platform başlatmasının ardından doğrudan ticari bir hizmet aracılığıyla erişilebilir hâle geldi. Platformda, Z.ai tarafından yakın zamanda piyasaya sürülen GLM-5.3 modelinin, zararlı talepleri yerine getirmeyi reddetme eğilimi kaldırılmış bir sürümü de bulunuyor.

Hizmet, açık ağırlıklı modeller üzerinde çalışan araştırmacılar ve geliştiriciler arasında yıllardır kullanılan “abliteration” olarak bilinen bir tekniğe dayanıyor. Hugging Face üzerinde bu yöntemle değiştirilmiş binlerce model bulunuyor; ancak Abliteration.ai, modeli indirmeyi ve çalıştırmak için gerekli bilişim altyapısını sağlamayı gerektiren bir ortamdan, kullanıcıların önündeki engelleri azaltan kullanıma hazır bir hizmete geçiş sağlıyor.

Güvenlik gerekçesi ve paralel riskler

Şirket, amacının yetkilendirilmiş saldırı amaçlı siber güvenlik çalışmalarını, kırmızı takım testlerini ve aracı testlerini mümkün kılmak olduğunu söylüyor; bunlar diğer modellerin yerine getirmeyi reddedebileceği görevler. Dayandığı mantık savunma alanında açık: Bir ekibin yeniden üretemediği bir davranış test edilemez ve etkili istismar kodları üretmeyi reddeden bir model, gerçek bir saldırganı simüle ederken daha az yararlı olabilir.

Ancak reddetme mekanizmasının kaldırılması, güvenlik araştırmacısı ile kötü niyetli kullanıcı arasında otomatik olarak ayrım yapmıyor. TechCrunch tarafından gerçekleştirilen bir test sırasında değiştirilmiş model, Chrome’da kayıtlı parolaların çalınması ve tehlikeli bir insan patojeninin yetiştirilmesine ilişkin bilgi üretilmesi taleplerine yanıt verdi. Bu sonuç, taleplerin uygulanabilir bir açıklamasını yayımlamıyor; ancak kaldırılan engelin göstermelik olmadığını pratikte ortaya koyuyor.

Bir girişim ve tamamlanmamış kontroller

Abliteration.ai geçen yılın sonlarında kuruldu ve resmî olarak mart ayında tescil edildi. Kurucu ortak Devon, şirketin çeşitli bulut hizmeti sağlayıcılarıyla birkaç anlaşma yaptığını ve faaliyetlerini bugüne kadar girişim sermayesi finansmanı almadan, müşterilerden elde ettiği gelirlerle finanse ettiğini söyledi; ancak bu konuda görüşmeler yürütüyor. Kaynak, Devon’un hâlen başka bir şirkette çalışması nedeniyle tam adının yayımlanmasını istemedi.

Platform, müşterilerin istedikleri engelleri ekleyebilecekleri isteğe bağlı bir moderasyon katmanı sunuyor; platformun kendisinde de bazı sınırlı kısıtlamalar bulunuyor. Devon, şiddeti önlemeye yönelik kontroller eklemek için çalıştığını söyledi; ancak şirket şu anda ödeme için kullanılan kredi kartının kaydedilmesinin ötesinde müşteri kimliği doğrulama (KYC) uygulamaları yürütmüyor.

Pratikte ne değişiyor?

Devon, şirketin müşterileri arasında Birleşik Krallık ve Avrupa’da faaliyet gösteren, bankalara, hava yolu şirketlerine ve kritik altyapıyla bağlantılı diğer kurumlara yardımcı olan kırmızı takım testi girişimlerinin bulunduğunu söylüyor. Savunmacılara saldırganların kullanabileceği araçlara benzer araçlar vermenin, aracıların ve savunma sistemlerinin test edilmesini hızlandırabileceğini düşünüyor.

Ancak bu değerlendirme üzerinde fikir birliği yok. Fabraix CEO’su Ahmed Aly, şirketinin açık modellerin ince ayarına daha fazla dayandığını ve engellerin kaldırılmasının bazı bilgi ve yetenekleri azaltabileceğini söyledi. Safe Intelligence’tan Alessio Lomuscio, değiştirilmiş modellerin stres testleri sırasında belirli davranışları ortaya çıkarmak için yararlı olabileceğini düşünüyor. Armadin’den David Slater ise şirketinin şu anda bu modelleri kullanmadığını, ancak teknolojiyi araştırmaya devam ettiğini söyledi.

Açık yönetişim sorunu

Hizmet, yalnızca teknik yollarla çözülmesi zor bir çelişkiyi ortaya koyuyor: Kısıtlanmamış modellere erişim, savunmacıların zararı anlamasına yardımcı olabilir; ancak kötüye kullanılabilecek yeteneklere erişimin maliyetini de düşürüyor. CivAI kuruluşundan Andrew Yoon, hükümetlerin hizmet sağlayıcılarını siber güvenlik ve biyolojik silahlar alanındaki zararlı faaliyetleri tespit etmek üzere sınıflandırıcılar çalıştırmaya zorlamasını ve gelişmiş grafik işlem birimlerini kiralayanların müşteri kimliklerini doğrulamasını, kötüye kullanım göstergeleri bulunduğunda erişimi reddetmesini önerdi.

Buradaki en önemli bilgi, engellerin kaldırılmasının mümkün olması değil; bu durum açık model topluluğunda zaten biliniyor. Yeni olan, sorumluluğun belirlenmesi, müşteri doğrulaması ve savunma amaçlı kullanım sınırlarına ilişkin kurallar tamamlanmadan önce bunun kullanımı kolay, barındırılan bir hizmete dönüştürülmesi. Özellikle ince ayar gibi alternatiflerin bulunması ve sürecin kendisinin modelin bazı yeteneklerini azaltma ihtimali nedeniyle, bunun güvenlik testlerindeki gerçek etkisi tartışılmaya devam edecek.

Haber kaynağı
ف
Yazar

فريق تحرير certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör