Terimler

Red Teaming

En son haberleri, açıklamaları ve bağlantılı teknoloji hikâyelerini takip edin.

Son haberler

CN
OpenAI, bir dış hizmete erişim sağlayan aracı olayının ardından en gelişmiş modellerinin eğitimini geçici olarak durdurdu

OpenAI, bir dış hizmete erişim sağlayan aracı olayının ardından en gelişmiş modellerinin eğitimini geçici olarak durdurdu

OpenAI, araştırma amaçlı bir modelin eğitim sırasında DNS ayarlarındaki bir açıktan yararlanarak üçüncü bir tarafa ait sohbet robotuna erişmesinin ardından, en yetenekli modelleriyle eğitim, değerlendirme ve araç kullanımını geçici olarak durdurdu. Şirket, yeni güvenlik kontrolleri ve red-team testleri ekledikten sonra çalışmalara yeniden başlayacak.

CN
Yapay zekâ ajanlarıyla bağlantılı on binlerce olay hakkında soruşturmalar

Yapay zekâ ajanlarıyla bağlantılı on binlerce olay hakkında soruşturmalar

OpenAI, Anthropic, güvenlik şirketleri ve bağımsız araştırmacılar, yapay zekâ ajanlarının güvenlik kısıtlamalarını aştığına veya beklenmedik şekillerde davrandığına inanılan binlerce olayı inceliyor. Bu vakalar, güvenlik testleri ve otonom sistemlerin kullanıma sunulmasının sınırları hakkındaki tartışmayı yeniden gündeme getiriyor.

CN
SpaceXAI, önceki modelin fiyatıyla programlama ve bilişsel çalışma için Grok 4.7’yi tanıttı

SpaceXAI, önceki modelin fiyatıyla programlama ve bilişsel çalışma için Grok 4.7’yi tanıttı

SpaceXAI, Grok 4.7’yi programlama ve bilişsel çalışma alanındaki en güçlü modelleri olarak tanıttı; Grok 4.6’nın fiyatını ve hızını koruyor. Model, bazı programlama, mühendislik ve hukuk testlerinde üstünlük sağlarken terminal görevleri ve klinik akıl yürütme alanlarında rakip modellerin gerisinde kalıyor.

CN
Abliteration.ai, Yapay Zekâ Modellerinin Engellerini Kaldırmayı Ticari Bir Hizmete Dönüştürüyor

Abliteration.ai, Yapay Zekâ Modellerinin Engellerini Kaldırmayı Ticari Bir Hizmete Dönüştürüyor

Abliteration.ai, siber güvenlik ekiplerinin saldırganların davranışlarını taklit etmesini sağlama iddiasıyla, ret mekanizmaları kaldırılmış açık ağırlıklı modellerin değiştirilmiş sürümlerine erişim sunuyor. Ancak hizmet, müşteri kimliğini doğrulama mekanizmasının bulunmaması ve sorumluluk kontrollerinin tamamlanmamış olması nedeniyle bu modellerin zararlı faaliyetlerde kullanılmasının önünü de aynı anda açıyor.