Cibersegurança

OpenAI revela Astra como o primeiro modelo a atingir o limiar de «capacidade cibernética crítica» da empresa

A OpenAI afirmou que o modelo Astra consegue descobrir vulnerabilidades desconhecidas e desenvolver métodos para explorá-las, e que obteve pontuação máxima no teste ExploitBench. A empresa disponibilizará gradualmente suas capacidades cibernéticas a usuários de teste após adiar parte do processo de desenvolvimento para adicionar controles de segurança, sem que haja, até o momento, uma verificação independente.

2026-09-02
4 min de leitura
6 visualizações
certi.news
OpenAI revela Astra como o primeiro modelo a atingir o limiar de «capacidade cibernética crítica» da empresa

A OpenAI revelou novos detalhes sobre o modelo de inteligência artificial Astra, que se prepara para disponibilizar em breve, e afirmou que ele é o primeiro modelo da empresa a atingir o nível de «capacidade cibernética crítica» no âmbito do Preparedness Framework. Segundo a descrição da empresa, isso significa que o modelo consegue, quando recebe as ferramentas e os direitos de acesso adequados, descobrir vulnerabilidades de segurança anteriormente desconhecidas e desenvolver formas de explorá-las.

O avanço não diz respeito apenas à capacidade do modelo de analisar código ou sugerir correções, mas também à sua capacidade de executar etapas avançadas da cadeia de exploração. Por esse motivo, a OpenAI adiou parte do desenvolvimento e do lançamento do Astra, enquanto trabalhou nas últimas semanas para reduzir a probabilidade de ele ser usado em ataques cibernéticos prejudiciais ou para executar operações não autorizadas.

Resultados fortes em testes de exploração

A OpenAI afirmou que o Astra obteve uma pontuação de 100% no teste ExploitBench, que mede a capacidade de desenvolver softwares de exploração para vulnerabilidades conhecidas. A empresa também realizou uma avaliação interna que incluiu 20 vulnerabilidades de alta gravidade divulgadas durante o período de junho a agosto de 2026.

De acordo com os resultados apresentados pela OpenAI, o Astra alcançou, nessa avaliação, taxas mais altas de execução remota de código em comparação com o modelo GPT-5.6 Sol, utilizando um número menor de unidades de tokens. Durante o teste, a empresa afirmou que o modelo descobriu e utilizou duas vulnerabilidades de «dia zero» como parte de uma cadeia de exploração, e que começou a notificar os desenvolvedores de software envolvidos sobre essas vulnerabilidades.

Outros testes realizados por especialistas avaliaram a capacidade do Astra de explorar vulnerabilidades desconhecidas em um navegador protegido, sair do ambiente isolado e executar comandos no sistema hospedeiro. Em testes de sistemas operacionais, o modelo conseguiu, segundo a OpenAI, encadear várias vulnerabilidades para obter acesso de um usuário não autorizado a privilégios de root.

Disponibilidade limitada e controles adicionais

A OpenAI planeja disponibilizar gradualmente as capacidades cibernéticas mais avançadas do Astra. A primeira fase será limitada a um grupo de usuários participantes dos testes, antes da ampliação do acesso a usos defensivos por meio do programa Daybreak Blue.

A empresa afirma que aumentou a taxa de recusa do Astra a solicitações cibernéticas prejudiciais e que imporá restrições mais rigorosas às contas que considerar de alto risco. Também adicionará mecanismos de monitoramento para detectar comportamentos não autorizados, além de camadas de raciocínio e supervisão sobre as ações executadas pelo modelo.

Por que esta notícia é importante?

Na prática, o que muda é a transição de um modelo geral para um nível em que ele pode, segundo os testes da empresa, contribuir para descobrir e explorar vulnerabilidades por meio de uma cadeia de várias etapas. Isso pode beneficiar equipes de defesa e pesquisadores de segurança se o uso permanecer restrito a ambientes autorizados, mas, ao mesmo tempo, aumenta a sensibilidade do controle de acesso e do monitoramento, porque as mesmas capacidades podem reduzir o esforço necessário para desenvolver ataques complexos.

Aqui se destacam os limites das informações disponíveis. Os números e resultados apresentados têm como fonte a OpenAI, e ainda não existe uma verificação independente do nível de segurança do Astra ou das medidas para reduzir seu uso indevido. Além disso, o sistema completo e os resultados detalhados das avaliações não serão publicados, segundo o material, até o lançamento oficial. Por isso, a avaliação prática das capacidades e dos riscos do modelo dependerá do sistema de segurança publicado e dos resultados de testes independentes após a disponibilização, e não apenas das alegações iniciais de desempenho.

Fonte da notícia
c
Autor

certi.news

Na mesma categoria

Você também pode gostar

Ver todas as notícias