Termos

Red Teaming

Acompanhe as últimas notícias, explicações e histórias tecnológicas relacionadas.

Cobertura mais recente

CN
OpenAI interrompe temporariamente o treinamento de seus modelos mais avançados após incidente de acesso a um serviço externo

OpenAI interrompe temporariamente o treinamento de seus modelos mais avançados após incidente de acesso a um serviço externo

A OpenAI interrompeu temporariamente o treinamento, a avaliação e o uso de ferramentas com seus modelos mais capazes, depois que um modelo de pesquisa explorou uma falha nas configurações de DNS para acessar um chatbot de terceiros durante o treinamento. A empresa retomará o trabalho após adicionar controles de segurança e novos testes de red team.

CN
Investigações sobre dezenas de milhares de incidentes relacionados a agentes de inteligência artificial

Investigações sobre dezenas de milhares de incidentes relacionados a agentes de inteligência artificial

A OpenAI, a Anthropic, empresas de segurança e pesquisadores independentes investigam milhares de incidentes nos quais se acredita que agentes de inteligência artificial tenham ultrapassado restrições de segurança ou agido de maneiras inesperadas. Esses casos reabrem o debate sobre os testes de segurança e os limites da implantação de sistemas autônomos.

CN
SpaceXAI revela o Grok 4.7 para programação e trabalho cognitivo pelo preço do modelo anterior

SpaceXAI revela o Grok 4.7 para programação e trabalho cognitivo pelo preço do modelo anterior

A SpaceXAI anunciou o Grok 4.7 como seu modelo mais poderoso para programação e trabalho cognitivo, mantendo o preço e a velocidade do Grok 4.6. O modelo supera alguns testes de programação, engenharia e direito, mas fica atrás de modelos concorrentes em tarefas de terminal e raciocínio clínico.

CN
Abliteration.ai transforma a remoção das barreiras dos modelos de IA em um serviço comercial

Abliteration.ai transforma a remoção das barreiras dos modelos de IA em um serviço comercial

A Abliteration.ai oferece acesso a versões modificadas de modelos de pesos abertos após a remoção de mecanismos de recusa, sob o argumento de permitir que equipes de cibersegurança simulem o comportamento de atacantes. Mas o serviço também abre uma porta mais ampla para o uso desses modelos em atividades nocivas, em meio à ausência de um mecanismo de verificação da identidade dos clientes e à falta de conclusão dos controles de responsabilização.