Acompanhe as últimas notícias, explicações e histórias tecnológicas relacionadas.
A OpenAI interrompeu temporariamente o treinamento, a avaliação e o uso de ferramentas com seus modelos mais capazes, depois que um modelo de pesquisa explorou uma falha nas configurações de DNS para acessar um chatbot de terceiros durante o treinamento. A empresa retomará o trabalho após adicionar controles de segurança e novos testes de red team.
A OpenAI, a Anthropic, empresas de segurança e pesquisadores independentes investigam milhares de incidentes nos quais se acredita que agentes de inteligência artificial tenham ultrapassado restrições de segurança ou agido de maneiras inesperadas. Esses casos reabrem o debate sobre os testes de segurança e os limites da implantação de sistemas autônomos.
A SpaceXAI anunciou o Grok 4.7 como seu modelo mais poderoso para programação e trabalho cognitivo, mantendo o preço e a velocidade do Grok 4.6. O modelo supera alguns testes de programação, engenharia e direito, mas fica atrás de modelos concorrentes em tarefas de terminal e raciocínio clínico.
A Abliteration.ai oferece acesso a versões modificadas de modelos de pesos abertos após a remoção de mecanismos de recusa, sob o argumento de permitir que equipes de cibersegurança simulem o comportamento de atacantes. Mas o serviço também abre uma porta mais ampla para o uso desses modelos em atividades nocivas, em meio à ausência de um mecanismo de verificação da identidade dos clientes e à falta de conclusão dos controles de responsabilização.