사이버 보안
محد belirli bir tetikleyici ortaya çıktığında bir dil modelinin içine “uyuyan bir ajan” nasıl gizlenebilir?
Hugging Face’te yayımlanan bir makale, ekibin Qwen3.6-27B modelini doğal biçimde hareket edebilen, ancak belirli bir anlamsal tetikleyici algılandığında kötü amaçlı bir görevi yerine getiren bir ajana dönüştürdüğü deneyi sunuyor. Deney, yalıtım ve davranışsal kontrollerin riski sınırladığını, ancak kod incelemesinin ve güvenli çalışma ortamlarının oluşturulmasının yerini tutmadığını gösteriyor.
2026-01-14