Следите за последними материалами, объяснениями и связанными технологическими историями.
В статье на Hugging Face описывается эксперимент, в котором команда превратила модель Qwen3.6-27B в агента, способного вести себя естественно, а затем выполнять вредоносную задачу при обнаружении определённого семантического триггера. Эксперимент показывает, что изоляция и поведенческие средства контроля снижают риск, но не заменяют проверку кода и создание безопасных сред выполнения.