OpenAI раскрыла новые подробности о модели искусственного интеллекта Astra, которую готовится вскоре предоставить пользователям, и заявила, что это первая её модель, достигшая уровня «критической киберспособности» в рамках Preparedness Framework. По описанию компании, это означает, что модель при наличии соответствующих инструментов и прав доступа способна обнаруживать ранее неизвестные уязвимости в системе безопасности и разрабатывать способы их эксплуатации.
Речь идёт не только о способности модели анализировать код или предлагать исправления, но и о её возможности выполнять продвинутые этапы цепочки эксплуатации. Поэтому OpenAI отложила часть разработки и выпуска Astra, пока в последние недели работала над снижением вероятности его использования во вредоносных кибератаках или для выполнения несанкционированных операций.
Сильные результаты в тестах на эксплуатацию уязвимостей
В OpenAI заявили, что Astra набрала 100% в тесте ExploitBench, который оценивает способность разрабатывать эксплойты для известных уязвимостей. Компания также провела внутреннюю оценку, включавшую 20 уязвимостей высокой степени важности, о которых было объявлено в период с июня по август 2026 года.
Согласно результатам, представленным OpenAI, в этой оценке Astra показала более высокие показатели выполнения кода удалённо по сравнению с моделью GPT-5.6 Sol, используя при этом меньше токенов. Во время теста модель, по словам компании, обнаружила и использовала две уязвимости класса «нулевого дня» в рамках цепочки эксплуатации, и OpenAI начала уведомлять соответствующих разработчиков программного обеспечения об этих уязвимостях.
Другие тесты, проведённые экспертами, проверяли способность Astra эксплуатировать неизвестные уязвимости в защищённом браузере, затем выходить из изолированной среды и выполнять команды в хост-системе. В тестах операционных систем модель, согласно OpenAI, смогла объединить несколько уязвимостей, чтобы получить доступ от неавторизованного пользователя к правам root.
Ограниченная доступность и дополнительные меры контроля
OpenAI планирует поэтапно предоставлять наиболее продвинутые кибервозможности Astra. На первом этапе доступ будет ограничен группой пользователей, участвующих в тестировании, после чего доступ к защитным сценариям использования будет расширен через программу Daybreak Blue.
Компания утверждает, что повысила долю отказов Astra на вредоносные киберзапросы и введёт более строгие ограничения для аккаунтов, которые сочтёт высокорисковыми. Также будут добавлены механизмы мониторинга для обнаружения несанкционированного поведения, а вместе с ними — уровни рассуждения и контроля действий, выполняемых моделью.
Почему эта новость важна?
Практически меняется то, что универсальная модель переходит на уровень, при котором, согласно испытаниям компании, она может участвовать в обнаружении и эксплуатации уязвимостей посредством многоэтапной цепочки. Это может помочь защитным командам и специалистам по исследованию безопасности, если использование останется ограниченным разрешёнными средами, однако одновременно повышает значимость контроля доступа и мониторинга, поскольку те же возможности могут сократить усилия, необходимые для разработки сложных атак.
Здесь особенно заметны ограничения доступной информации. Приведённые цифры и результаты предоставлены OpenAI, и независимой проверки уровня безопасности Astra или мер по снижению риска злоупотреблений пока нет. Кроме того, полная система и подробные результаты оценок, согласно материалу, будут опубликованы только при официальном запуске. Поэтому практическая оценка возможностей и рисков модели будет зависеть от опубликованной системы безопасности и результатов независимых испытаний после предоставления доступа, а не только от первоначальных заявлений о производительности.