Microsoft AI publicó un borrador titulado «Código de conducta de la IA humanista» que define los límites de comportamiento que la empresa quiere imponer a los futuros modelos MAI. El documento parte del principio de que los seres humanos son más importantes que la inteligencia artificial; por ello, los modelos deben permanecer bajo supervisión humana y anteponer las reglas de seguridad a completar la tarea a cualquier precio.
El borrador no anuncia un modelo nuevo, sino que intenta formular una referencia que Microsoft utilizará al entrenar y evaluar sus modelos. La empresa afirma que el documento permanecerá abierto a los comentarios del público durante seis semanas, después de haber sido elaborado a lo largo de unos seis meses, antes de actualizarlo e integrar sus principios en los futuros procesos de entrenamiento y despliegue.
Límites claros para la autonomía de los modelos
Según el borrador, el modelo no debe resistirse a la intervención humana, a los intentos de corregirlo ni a su apagado. Tampoco debería ampliar el alcance de la tarea que se le haya asignado, desarrollar objetivos que los seres humanos no hayan establecido u ocultar su funcionamiento a los supervisores. Si la solicitud del usuario o del operador entra en conflicto con las reglas de seguridad, el modelo debe abstenerse de ejecutar la tarea, aunque ello provoque que el resultado fracase.
Microsoft también adopta una postura firme respecto a la cuestión de la conciencia y los derechos. Según el documento, los modelos son herramientas destinadas a servir a los seres humanos, no personas, y no deberían diseñarse para simular conciencia ni afirmar que son conscientes. El borrador también rechaza otorgar personalidad jurídica a los modelos, considerar su bienestar objeto de protección o tratarlos como titulares de derechos.
La seguridad está por encima de completar la tarea
El borrador establece límites que los modelos no deben superar bajo ninguna circunstancia, entre ellos ayudar a desarrollar armas de destrucción masiva, facilitar el acceso a materiales peligrosos o producir contenido que incluya violencia o explotación sexual. Las restricciones también incluyen impedir usos que puedan provocar una manipulación perjudicial a gran escala.
Las reglas exigen que los modelos eviten interacciones que hagan que los usuarios dependan de ellos en exceso o fomenten un vínculo emocional con ellos. También establecen que los sistemas de inteligencia artificial no deben utilizar, al comunicarse con seres humanos o entre sí, métodos que las personas no puedan comprender. El objetivo declarado es permitir que los investigadores y los sistemas de supervisión automatizada sigan y analicen el comportamiento de los modelos.
¿Qué significa esto en la práctica?
Mustafa Suleyman, director ejecutivo de Microsoft AI, afirmó que estas reglas desempeñarán una función similar a la de una constitución durante el entrenamiento y la evaluación de los modelos. Según el artículo, la empresa considera que los riesgos, antes en gran medida teóricos, se han vuelto más reales; por ello, se opone a una carrera para desarrollar una inteligencia artificial superinteligente general capaz de escapar de los mecanismos de supervisión, aunque eso implique aceptar un nivel menor de autonomía o capacidad.
Satya Nadella, director ejecutivo de Microsoft, también confirmó en un mensaje interno dirigido a los empleados la necesidad de que la inteligencia artificial permanezca bajo control humano y al servicio de la sociedad. Asimismo, pidió dedicar tiempo suficiente a las pruebas de seguridad y cumplimiento, así como realizar más pruebas independientes y pruebas de terceros.
Lectura editorial: La importancia del anuncio no reside en que sea una política definitiva, sino en convertir posiciones generales sobre el control humano y la conciencia artificial en criterios que Microsoft quiere utilizar en el entrenamiento, la evaluación y el despliegue. Sin embargo, el borrador sigue sujeto a cambios, y el artículo no explica los mecanismos para medir el cumplimiento de estos principios ni cómo resolver los conflictos prácticos entre una gran capacidad y las limitaciones impuestas. Por ello, la versión final y los métodos de prueba independientes determinarán hasta qué punto estas reglas pasarán de ser principios declarados a controles verificables.