Anthropic pide a los gobiernos que actualicen sus políticas para seguir el ritmo de la aceleración de las capacidades de la inteligencia artificial mediante dos propuestas que abarcan la gobernanza de los modelos avanzados y la preparación para el impacto de la tecnología en los trabajadores y la economía. La empresa considera que la velocidad de evolución de los modelos hace que la transparencia por sí sola sea insuficiente y que las autoridades gubernamentales necesitan mayores facultades para abordar despliegues que puedan implicar riesgos catastróficos, estableciendo al mismo tiempo salvaguardas que impidan el uso indebido de esas facultades.
La primera propuesta consiste en el Marco de Inteligencia Artificial Avanzada, centrado en los modelos más potentes y los riesgos que pueden derivarse de ellos. La segunda, el Marco Económico, aborda cómo preparar a los trabajadores y la economía para el impacto de la inteligencia artificial y garantizar que sus beneficios financieros se compartan ampliamente. Anthropic afirma que ambos marcos abordan dos aspectos de un mismo desafío: orientar responsablemente la tecnología a medida que avanza y prepararse para los cambios que traerá a la sociedad.
Alcance de las normas propuestas
El marco avanzado propone aplicar las normas a los modelos entrenados con más de 1025 operaciones de coma flotante y desarrollados por empresas que obtengan más de 500 millones de dólares en ingresos relacionados con la inteligencia artificial o gasten más de 1.000 millones de dólares en investigación y desarrollo en este campo. Anthropic afirma que este alcance se dirige a los modelos de frontera, en lugar de imponer los mismos requisitos a todos los sistemas de inteligencia artificial.
La empresa vincula la necesidad de este tipo de regulación con la marcada tendencia ascendente de las capacidades de los modelos. Señala que, hace unos años, los modelos apenas podían escribir código, mientras que el modelo Claude Mythos Preview descubrió, según Anthropic, miles de vulnerabilidades de software de alto riesgo, incluidas vulnerabilidades en todos los principales sistemas operativos y navegadores. La empresa concluye que la continuación de esta tendencia podría aumentar los riesgos de daños catastróficos.
Cuatro tipos de riesgos
El marco se centra en cuatro áreas principales de riesgo:
- Riesgos biológicos: los sistemas sin protección podrían facilitar y abaratar el desarrollo de armas biológicas, aunque esas mismas capacidades también pueden acelerar el descubrimiento de medicamentos.
- Riesgos cibernéticos: los modelos avanzados de inteligencia artificial pueden descubrir vulnerabilidades críticas a gran escala, lo que podría ayudar a defender los sistemas, pero también eleva el nivel de amenaza para infraestructuras esenciales, como hospitales y redes eléctricas.
- Riesgos de pérdida de control: controlar sistemas que actúan fuera del alcance de sus desarrolladores podría resultar más difícil a medida que mejoren sus capacidades.
- Investigación y desarrollo automatizados: los sistemas pueden automatizar la investigación y el desarrollo de la inteligencia artificial, lo que podría multiplicar los tres riesgos anteriores.
Requisitos para los desarrolladores de modelos avanzados
Anthropic propone que los desarrolladores de modelos avanzados prueben sus sistemas y publiquen un resumen de los resultados, junto con un marco de seguridad que explique cómo evaluar los riesgos catastróficos y fichas de sistema que describan las capacidades y los riesgos de los modelos. El marco también pide publicar informes periódicos sobre la situación general de los riesgos y realizar evaluaciones independientes de forma regular. La empresa señala que algunas exigencias de transparencia ya están impuestas por leyes de California y Nueva York, pero considera que su propuesta va más allá en ciertos aspectos.
Según la propuesta, cada desarrollador de modelos avanzados debería contratar al menos a un evaluador independiente cualificado, que publicaría una revisión de las evaluaciones y los informes de riesgos de la empresa. Anthropic también pide a los gobiernos y al sector tecnológico que desarrollen un ecosistema de evaluadores independientes mediante el establecimiento de estándares para ellos, la provisión de financiación y la concesión de un acceso suficiente a los modelos.
El marco incluye asimismo requisitos de seguridad para proteger los pesos de los modelos y la infraestructura utilizada en el entrenamiento, considerados objetivos valiosos para los atacantes, incluidas entidades gubernamentales con grandes recursos. La empresa propone proteger todo el entorno de desarrollo frente a amenazas externas e internas, describir públicamente el programa de seguridad a nivel general, proporcionar detalles a una autoridad gubernamental específica cuando se soliciten, crear canales para informar sobre ataques de imitación de modelos y probar las defensas periódicamente.
Facultades gubernamentales con controles
Anthropic considera que los gobiernos deberían tener la capacidad legal de impedir o disuadir el despliegue de modelos que supongan un riesgo considerable de causar daños catastróficos, imponiendo sanciones civiles vinculadas a los ingresos anuales globales y aumentando su gravedad cuando se repitan las infracciones. Al mismo tiempo, advierte contra unas facultades regulatorias amplias o gravosas y propone un mecanismo específico para impedir despliegues peligrosos y salvaguardas concretas que limiten el uso indebido de esa autoridad.
El marco se centra principalmente en el Gobierno federal estadounidense, pero no pide eliminar las leyes estatales salvo que se apruebe una ley federal al menos tan sólida como la propuesta. Anthropic afirma que la eliminación de las facultades estatales debería ser limitada, de modo que los estados sigan pudiendo regular cuestiones como la seguridad infantil y la protección del consumidor, siempre que queden fuera de las funciones de seguridad específicas que cubra la ley federal.
Fortalecer la resiliencia de la sociedad
La segunda parte del marco propone medidas para aumentar la capacidad de la sociedad de hacer frente a los riesgos. En el ámbito biológico, las recomendaciones incluyen examinar la síntesis de genes, vigilar nuevos brotes mediante sistemas de alerta temprana y prepararse almacenando equipos de protección y medios para limitar la transmisión por el aire.
En el ámbito cibernético, Anthropic pide reforzar el software del que depende Internet, proporcionar apoyo técnico a los operadores de infraestructuras esenciales y sustituir los sistemas antiguos utilizados en ellas. También propone crear una función gubernamental específica para seguir las capacidades cibernéticas de los modelos avanzados, así como la cooperación entre el Gobierno y el sector tecnológico para desarrollar medios de protección que permitan compartir ampliamente las capacidades cibernéticas.
La empresa reconoce que la agenda de resiliencia frente a los riesgos de pérdida de control y de investigación y desarrollo automatizados sigue estando menos desarrollada y necesita más trabajo en todo el sector. Entre las líneas que menciona se encuentran desarrollar capacidades para detectar y responder a sistemas que actúen fuera del control de sus desarrolladores, y construir una infraestructura para contener o detener esos sistemas.
Anthropic espera un amplio debate sobre sus propuestas, pero insta a los responsables de formular políticas a involucrarse ahora en estas cuestiones, mientras las capacidades de la inteligencia artificial siguen mejorando durante los próximos meses. Afirma que la gobernanza de la tecnología debe mantenerse al día con esta evolución, aunque las propuestas planteadas sigan siendo objeto de debate y evaluación.