Кибербезопасность

OpenAI представляет Astra как первую модель, достигшую порога «критической киберспособности»

В OpenAI заявили, что модель Astra способна обнаруживать неизвестные уязвимости и разрабатывать методы их эксплуатации, а также набрала максимальный результат в тесте ExploitBench. Компания будет постепенно предоставлять её киберспособности тестовым пользователям после приостановки части разработки для добавления мер безопасности; независимой проверки пока нет.

2026-09-02
3 мин. чтения
6 просмотров
certi.news
OpenAI представляет Astra как первую модель, достигшую порога «критической киберспособности»

OpenAI раскрыла новые подробности о модели искусственного интеллекта Astra, которую готовится вскоре предоставить пользователям, и заявила, что это первая её модель, достигшая уровня «критической киберспособности» в рамках Preparedness Framework. По описанию компании, это означает, что модель при наличии соответствующих инструментов и прав доступа способна обнаруживать ранее неизвестные уязвимости в системе безопасности и разрабатывать способы их эксплуатации.

Речь идёт не только о способности модели анализировать код или предлагать исправления, но и о её возможности выполнять продвинутые этапы цепочки эксплуатации. Поэтому OpenAI отложила часть разработки и выпуска Astra, пока в последние недели работала над снижением вероятности его использования во вредоносных кибератаках или для выполнения несанкционированных операций.

Сильные результаты в тестах на эксплуатацию уязвимостей

В OpenAI заявили, что Astra набрала 100% в тесте ExploitBench, который оценивает способность разрабатывать эксплойты для известных уязвимостей. Компания также провела внутреннюю оценку, включавшую 20 уязвимостей высокой степени важности, о которых было объявлено в период с июня по август 2026 года.

Согласно результатам, представленным OpenAI, в этой оценке Astra показала более высокие показатели выполнения кода удалённо по сравнению с моделью GPT-5.6 Sol, используя при этом меньше токенов. Во время теста модель, по словам компании, обнаружила и использовала две уязвимости класса «нулевого дня» в рамках цепочки эксплуатации, и OpenAI начала уведомлять соответствующих разработчиков программного обеспечения об этих уязвимостях.

Другие тесты, проведённые экспертами, проверяли способность Astra эксплуатировать неизвестные уязвимости в защищённом браузере, затем выходить из изолированной среды и выполнять команды в хост-системе. В тестах операционных систем модель, согласно OpenAI, смогла объединить несколько уязвимостей, чтобы получить доступ от неавторизованного пользователя к правам root.

Ограниченная доступность и дополнительные меры контроля

OpenAI планирует поэтапно предоставлять наиболее продвинутые кибервозможности Astra. На первом этапе доступ будет ограничен группой пользователей, участвующих в тестировании, после чего доступ к защитным сценариям использования будет расширен через программу Daybreak Blue.

Компания утверждает, что повысила долю отказов Astra на вредоносные киберзапросы и введёт более строгие ограничения для аккаунтов, которые сочтёт высокорисковыми. Также будут добавлены механизмы мониторинга для обнаружения несанкционированного поведения, а вместе с ними — уровни рассуждения и контроля действий, выполняемых моделью.

Почему эта новость важна?

Практически меняется то, что универсальная модель переходит на уровень, при котором, согласно испытаниям компании, она может участвовать в обнаружении и эксплуатации уязвимостей посредством многоэтапной цепочки. Это может помочь защитным командам и специалистам по исследованию безопасности, если использование останется ограниченным разрешёнными средами, однако одновременно повышает значимость контроля доступа и мониторинга, поскольку те же возможности могут сократить усилия, необходимые для разработки сложных атак.

Здесь особенно заметны ограничения доступной информации. Приведённые цифры и результаты предоставлены OpenAI, и независимой проверки уровня безопасности Astra или мер по снижению риска злоупотреблений пока нет. Кроме того, полная система и подробные результаты оценок, согласно материалу, будут опубликованы только при официальном запуске. Поэтому практическая оценка возможностей и рисков модели будет зависеть от опубликованной системы безопасности и результатов независимых испытаний после предоставления доступа, а не только от первоначальных заявлений о производительности.

Источник новости
c
Автор

certi.news

В той же категории

Вам также может понравиться

Все новости