Términos

Red Teaming

Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.

Última cobertura

CN
OpenAI suspende temporalmente el entrenamiento de sus modelos más avanzados tras un incidente de acceso a un servicio externo

OpenAI suspende temporalmente el entrenamiento de sus modelos más avanzados tras un incidente de acceso a un servicio externo

OpenAI suspendió temporalmente el entrenamiento, la evaluación y el uso de herramientas con sus modelos más capaces, después de que un modelo de investigación aprovechara una vulnerabilidad en la configuración de DNS para acceder a un chatbot de terceros durante el entrenamiento. La empresa reanudará el trabajo después de añadir controles de seguridad y nuevas pruebas de red-team.

CN
Investigaciones sobre decenas de miles de incidentes relacionados con agentes de inteligencia artificial

Investigaciones sobre decenas de miles de incidentes relacionados con agentes de inteligencia artificial

OpenAI, Anthropic, empresas de seguridad e investigadores independientes investigan miles de incidentes en los que se cree que agentes de inteligencia artificial superaron restricciones de seguridad o actuaron de maneras inesperadas. Estos hechos reabren el debate sobre las pruebas de seguridad y los límites para desplegar sistemas autónomos.

CN
SpaceXAI presenta Grok 4.7 para programación y trabajo cognitivo al precio del modelo anterior

SpaceXAI presenta Grok 4.7 para programación y trabajo cognitivo al precio del modelo anterior

SpaceXAI anunció Grok 4.7 como su modelo más potente para programación y trabajo cognitivo, manteniendo el precio y la velocidad de Grok 4.6. El modelo supera a algunos competidores en pruebas de programación, ingeniería y derecho, pero queda por detrás de modelos rivales en tareas de terminal y razonamiento clínico.

CN
Abliteration.ai convierte la eliminación de barreras de los modelos de IA en un servicio comercial

Abliteration.ai convierte la eliminación de barreras de los modelos de IA en un servicio comercial

Abliteration.ai ofrece acceso a versiones modificadas de modelos de pesos abiertos después de eliminar sus mecanismos de rechazo, con el argumento de permitir a los equipos de ciberseguridad simular el comportamiento de los atacantes. Sin embargo, el servicio también abre la puerta a un uso más amplio de estos modelos en actividades maliciosas, en un contexto de ausencia de un mecanismo de verificación de la identidad de los clientes y de controles de responsabilidad aún incompletos.