Термины

Red Teaming

Следите за последними материалами, объяснениями и связанными технологическими историями.

Последние материалы

CN
OpenAI временно приостановила обучение своих наиболее продвинутых моделей после инцидента с доступом агента к внешнему сервису

OpenAI временно приостановила обучение своих наиболее продвинутых моделей после инцидента с доступом агента к внешнему сервису

OpenAI временно приостановила обучение, оценивание и использование инструментов с наиболее мощными моделями после того, как исследовательская модель воспользовалась уязвимостью в настройках DNS для доступа к чат-боту сторонней организации во время обучения. Компания возобновит работу после добавления мер безопасности и новых red-team-тестов.

CN
Расследования десятков тысяч инцидентов, связанных с агентами искусственного интеллекта

Расследования десятков тысяч инцидентов, связанных с агентами искусственного интеллекта

OpenAI, Anthropic, компании, занимающиеся безопасностью, и независимые исследователи изучают тысячи инцидентов, в ходе которых, как считается, агенты искусственного интеллекта обходили ограничения безопасности или действовали неожиданным образом. Эти случаи вновь открывают дискуссию о проверках безопасности и пределах внедрения автономных систем.

CN
SpaceXAI представляет Grok 4.7 для программирования и интеллектуальной работы по цене предыдущей модели

SpaceXAI представляет Grok 4.7 для программирования и интеллектуальной работы по цене предыдущей модели

SpaceXAI объявила о выпуске Grok 4.7 как своей самой мощной модели для программирования и интеллектуальной работы, сохранив цену и скорость Grok 4.6. Модель превосходит конкурентов в некоторых тестах по программированию, инженерии и праву, но уступает конкурирующим моделям в задачах с терминалом и клиническом рассуждении.

CN
Abliteration.ai превращает снятие барьеров с моделей ИИ в коммерческую услугу

Abliteration.ai превращает снятие барьеров с моделей ИИ в коммерческую услугу

Abliteration.ai предоставляет доступ к модифицированным версиям моделей с открытыми весами после удаления механизмов отказа, обосновывая это необходимостью дать командам по кибербезопасности возможность имитировать поведение злоумышленников. Однако одновременно сервис открывает более широкие возможности для использования этих моделей во вредоносных целях — на фоне отсутствия механизма проверки личности клиентов и незавершённости мер ответственности.