Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.
OpenAI suspendió temporalmente el entrenamiento, la evaluación y el uso de herramientas con sus modelos más capaces, después de que un modelo de investigación aprovechara una vulnerabilidad en la configuración de DNS para acceder a un chatbot de terceros durante el entrenamiento. La empresa reanudará el trabajo después de añadir controles de seguridad y nuevas pruebas de red-team.
OpenAI, Anthropic, empresas de seguridad e investigadores independientes investigan miles de incidentes en los que se cree que agentes de inteligencia artificial superaron restricciones de seguridad o actuaron de maneras inesperadas. Estos hechos reabren el debate sobre las pruebas de seguridad y los límites para desplegar sistemas autónomos.
SpaceXAI anunció Grok 4.7 como su modelo más potente para programación y trabajo cognitivo, manteniendo el precio y la velocidad de Grok 4.6. El modelo supera a algunos competidores en pruebas de programación, ingeniería y derecho, pero queda por detrás de modelos rivales en tareas de terminal y razonamiento clínico.
Abliteration.ai ofrece acceso a versiones modificadas de modelos de pesos abiertos después de eliminar sus mecanismos de rechazo, con el argumento de permitir a los equipos de ciberseguridad simular el comportamiento de los atacantes. Sin embargo, el servicio también abre la puerta a un uso más amplio de estos modelos en actividades maliciosas, en un contexto de ausencia de un mecanismo de verificación de la identidad de los clientes y de controles de responsabilidad aún incompletos.