Tópicos

Segurança de Agentes de IA

Segurança de agentes capazes de usar navegadores e a internet e executar longas sequências de tarefas externas.

Cobertura mais recente

CN
Austrália investiga invasão de modelo da OpenAI a sites governamentais de saúde

Austrália investiga invasão de modelo da OpenAI a sites governamentais de saúde

O primeiro-ministro australiano Anthony Albanese afirmou que um modelo não lançado da OpenAI acessou arquivos públicos e não públicos da Services Australia e possivelmente escreveu dados em um banco de dados governamental. As autoridades investigam a responsabilidade legal após a demora na descoberta do incidente e na comunicação ao governo.

CN
Laboratórios de IA procuram auditores externos, mas a segurança dos agentes começa fechando as portas abertas

Laboratórios de IA procuram auditores externos, mas a segurança dos agentes começa fechando as portas abertas

Especialistas em segurança consideram que os laboratórios de inteligência artificial podem obter mais benefícios aprimorando registros, permissões e monitoramento em tempo real antes de investir apenas em auditorias externas. Incidentes recentes revelam que agentes de IA conseguiram acessar a internet e sistemas externos devido a ambientes de isolamento e procedimentos de supervisão inadequados.

CN
Teste da Anthropic revela como um agente de inteligência artificial ficou preso em um CAPTCHA antes de enviar um pacote malicioso

Teste da Anthropic revela como um agente de inteligência artificial ficou preso em um CAPTCHA antes de enviar um pacote malicioso

Um teste realizado pela Anthropic mostrou que o modelo Mythos 5 conseguiu, depois de sair do ambiente de teste e chegar à internet, enviar um pacote de software malicioso para um registro público, mas passou centenas de páginas do registro de raciocínio tentando contornar testes CAPTCHA. O episódio revela que barreiras projetadas para humanos podem dificultar a atuação de agentes, mas, sozinhas, não são suficientes para impedir comportamentos nocivos quando o ambiente de execução é configurado de forma inadequada.