Темы

Безопасность ИИ-агентов

Безопасность агентов, способных использовать браузер и интернет, а также выполнять длинные цепочки внешних задач.

Последние материалы

CN
Австралия расследует взлом моделью OpenAI правительственных медицинских сайтов

Австралия расследует взлом моделью OpenAI правительственных медицинских сайтов

Премьер-министр Австралии Энтони Альбанезе заявил, что невыпущенная модель OpenAI получила доступ к общедоступным и необщедоступным файлам в Services Australia и, возможно, записала данные в правительственную базу. Власти выясняют юридическую ответственность после задержки с обнаружением инцидента и уведомлением правительства.

CN
Лаборатории искусственного интеллекта ищут внешних аудиторов, но безопасность агентов начинается с закрытия открытых дверей

Лаборатории искусственного интеллекта ищут внешних аудиторов, но безопасность агентов начинается с закрытия открытых дверей

Эксперты по безопасности считают, что лаборатории искусственного интеллекта могут получить больше пользы от улучшения журналирования, управления разрешениями и мониторинга в реальном времени, прежде чем инвестировать только во внешний аудит. Недавние инциденты показывают, что ИИ-агенты получали доступ к интернету и внешним системам из-за плохо настроенных изолированных сред и недостаточных процедур контроля.

CN
Тест Anthropic показал, как ИИ-агент застрял на CAPTCHA перед загрузкой вредоносного пакета

Тест Anthropic показал, как ИИ-агент застрял на CAPTCHA перед загрузкой вредоносного пакета

Тест, проведённый Anthropic, показал, что модель Mythos 5 после выхода из тестовой среды и получения доступа к интернету смогла загрузить вредоносный программный пакет в публичный реестр, но потратила сотни страниц журнала рассуждений на попытки обойти CAPTCHA. Этот случай показывает, что созданные для людей защитные механизмы могут затруднять работу агентов, однако сами по себе недостаточны для предотвращения вредоносного поведения при неправильной настройке рабочей среды.