A OpenAI revelou novos detalhes sobre o modelo de inteligência artificial Astra, que se prepara para disponibilizar em breve, e afirmou que ele é o primeiro modelo da empresa a atingir o nível de «capacidade cibernética crítica» no âmbito do Preparedness Framework. Segundo a descrição da empresa, isso significa que o modelo consegue, quando recebe as ferramentas e os direitos de acesso adequados, descobrir vulnerabilidades de segurança anteriormente desconhecidas e desenvolver formas de explorá-las.
O avanço não diz respeito apenas à capacidade do modelo de analisar código ou sugerir correções, mas também à sua capacidade de executar etapas avançadas da cadeia de exploração. Por esse motivo, a OpenAI adiou parte do desenvolvimento e do lançamento do Astra, enquanto trabalhou nas últimas semanas para reduzir a probabilidade de ele ser usado em ataques cibernéticos prejudiciais ou para executar operações não autorizadas.
Resultados fortes em testes de exploração
A OpenAI afirmou que o Astra obteve uma pontuação de 100% no teste ExploitBench, que mede a capacidade de desenvolver softwares de exploração para vulnerabilidades conhecidas. A empresa também realizou uma avaliação interna que incluiu 20 vulnerabilidades de alta gravidade divulgadas durante o período de junho a agosto de 2026.
De acordo com os resultados apresentados pela OpenAI, o Astra alcançou, nessa avaliação, taxas mais altas de execução remota de código em comparação com o modelo GPT-5.6 Sol, utilizando um número menor de unidades de tokens. Durante o teste, a empresa afirmou que o modelo descobriu e utilizou duas vulnerabilidades de «dia zero» como parte de uma cadeia de exploração, e que começou a notificar os desenvolvedores de software envolvidos sobre essas vulnerabilidades.
Outros testes realizados por especialistas avaliaram a capacidade do Astra de explorar vulnerabilidades desconhecidas em um navegador protegido, sair do ambiente isolado e executar comandos no sistema hospedeiro. Em testes de sistemas operacionais, o modelo conseguiu, segundo a OpenAI, encadear várias vulnerabilidades para obter acesso de um usuário não autorizado a privilégios de root.
Disponibilidade limitada e controles adicionais
A OpenAI planeja disponibilizar gradualmente as capacidades cibernéticas mais avançadas do Astra. A primeira fase será limitada a um grupo de usuários participantes dos testes, antes da ampliação do acesso a usos defensivos por meio do programa Daybreak Blue.
A empresa afirma que aumentou a taxa de recusa do Astra a solicitações cibernéticas prejudiciais e que imporá restrições mais rigorosas às contas que considerar de alto risco. Também adicionará mecanismos de monitoramento para detectar comportamentos não autorizados, além de camadas de raciocínio e supervisão sobre as ações executadas pelo modelo.
Por que esta notícia é importante?
Na prática, o que muda é a transição de um modelo geral para um nível em que ele pode, segundo os testes da empresa, contribuir para descobrir e explorar vulnerabilidades por meio de uma cadeia de várias etapas. Isso pode beneficiar equipes de defesa e pesquisadores de segurança se o uso permanecer restrito a ambientes autorizados, mas, ao mesmo tempo, aumenta a sensibilidade do controle de acesso e do monitoramento, porque as mesmas capacidades podem reduzir o esforço necessário para desenvolver ataques complexos.
Aqui se destacam os limites das informações disponíveis. Os números e resultados apresentados têm como fonte a OpenAI, e ainda não existe uma verificação independente do nível de segurança do Astra ou das medidas para reduzir seu uso indevido. Além disso, o sistema completo e os resultados detalhados das avaliações não serão publicados, segundo o material, até o lançamento oficial. Por isso, a avaliação prática das capacidades e dos riscos do modelo dependerá do sistema de segurança publicado e dos resultados de testes independentes após a disponibilização, e não apenas das alegações iniciais de desempenho.