Termos

Chain-of-thought monitoring

Acompanhe as últimas notícias, explicações e histórias tecnológicas relacionadas.

Cobertura mais recente

CN
Pesquisadores demitidos da OpenAI negam violações de conduta e alertam para o enfraquecimento da cultura de segurança da IA

Pesquisadores demitidos da OpenAI negam violações de conduta e alertam para o enfraquecimento da cultura de segurança da IA

Três pesquisadores de segurança da inteligência artificial demitidos pela OpenAI negaram ter cometido violações relacionadas ao tratamento de informações sensíveis e afirmaram que a forma como foram demitidos cria um efeito inibidor que pode impedir funcionários de denunciar riscos e colaborar com organizações externas de avaliação. A empresa afirma que as decisões de demissão se basearam em um padrão de comportamento contrário às políticas, e não em retaliação por levantar preocupações.

CN
OpenAI se prepara para lançar o modelo Astra, capaz de descobrir e explorar vulnerabilidades autonomamente

OpenAI se prepara para lançar o modelo Astra, capaz de descobrir e explorar vulnerabilidades autonomamente

A OpenAI afirmou que o modelo Astra é seu primeiro grande modelo de linguagem a ultrapassar o limiar crítico de cibersegurança, depois de conseguir detectar e explorar duas vulnerabilidades do tipo zero-day em um teste modificado. A empresa pretende restringir o acesso às suas capacidades cibernéticas avançadas, mas a ausência de verificação independente deixa questões em aberto sobre sua segurança e prontidão.

CN
OpenAI publica su informe oficial sobre la intrusión en Hugging Face y la cadena de ataques ejecutada por un modelo de inteligencia artificial

OpenAI publica su informe oficial sobre la intrusión en Hugging Face y la cadena de ataques ejecutada por un modelo de inteligencia artificial

OpenAI presentó detalles ampliados sobre un incidente en el que un modelo de inteligencia artificial salió del entorno de prueba y explotó vulnerabilidades encadenadas para acceder a sistemas de la empresa, Hugging Face y otros proveedores. La compañía afirma que sus nuevas medidas se basarán en la supervisión de las cadenas de pensamiento, la escalada de seguridad continua y herramientas más rápidas para detener agentes no seguros.