La administración del presidente estadounidense Donald Trump presentó ante el tribunal un memorando de 20 páginas en apoyo de la posición de OpenAI en la demanda presentada por The New York Times, que sostiene que utilizar sin autorización materiales protegidos por derechos de autor para entrenar modelos de lenguaje de gran tamaño es ilegal. El memorando defiende la continuidad de este uso por considerarlo importante para preservar la competitividad de Estados Unidos en el ámbito de la inteligencia artificial.
El memorando afirma que Estados Unidos tiene «un fuerte interés en continuar desarrollando una industria de inteligencia artificial sólida y competitiva que establezca los estándares mundiales para la práctica y los procedimientos de la inteligencia artificial». También vincula esta posición con una orden ejecutiva firmada por Trump el año pasado, que pide mantener el liderazgo mundial de Estados Unidos en inteligencia artificial.
El núcleo de la disputa: ¿es el entrenamiento un uso legítimo?
Modelos como ChatGPT, Claude y Gemini dependen de enormes bases de datos que incluyen libros, artículos y obras mediáticas publicadas. Las empresas de inteligencia artificial sostienen que entrenar modelos con estas obras puede estar comprendido en el principio de «uso legítimo» de la ley de derechos de autor, una excepción que permite, en determinadas circunstancias, utilizar obras ajenas sin licencia.
Sin embargo, la aplicación de este principio al entrenamiento de inteligencia artificial sigue siendo objeto de un amplio debate jurídico. La discusión se centra especialmente en si el uso de las obras durante el entrenamiento es suficientemente «transformador», es decir, si produce una función o unos resultados diferentes de las obras originales, en lugar de copiarlas o sustituirlas.
El memorando de la administración estadounidense advierte que limitar el desarrollo de modelos de lenguaje de gran tamaño debido a lo que describe como una mala interpretación del principio de uso legítimo podría obstaculizar el progreso creativo y científico, y perjudicar la prosperidad y la movilidad económica en Estados Unidos.
¿Qué cambia con la intervención del Gobierno?
El memorando no es una resolución judicial, y la entidad que lo preparó no tiene autoridad para resolver la demanda. El caso está siendo examinado por el Tribunal de Distrito de Estados Unidos para el Distrito Sur de Nueva York, por lo que la decisión final sigue estando en manos del tribunal. No obstante, la intervención de la administración representa una posición oficial del Gobierno que puede añadir peso político y jurídico a los argumentos de OpenAI, en un momento en que las editoriales y los autores intentan definir los límites del uso de sus obras para entrenar modelos.
Los precedentes del caso indican que los resultados de las demandas relacionadas con el entrenamiento de inteligencia artificial y los derechos de autor han sido, hasta ahora, en gran medida favorables a las empresas de inteligencia artificial. El año pasado, el juez William Alsup ordenó a Anthropic pagar un acuerdo de 1.500 millones de dólares a un grupo de escritores, pero la sanción no estuvo vinculada al entrenamiento de modelos de inteligencia artificial en sí, sino al uso de bibliotecas clandestinas ilegales para piratear los libros utilizados en el entrenamiento.
Alsup comparó el entrenamiento de los modelos de Anthropic con la lectura humana de un libro con el objetivo de convertirse en escritor, y afirmó que los modelos fueron entrenados con las obras no para competir con ellas o sustituirlas, sino para desviarse en una dirección diferente y producir algo nuevo.
¿Por qué importa esta noticia?
El desarrollo confirma que la batalla por los datos de entrenamiento no se refiere a una sola empresa, sino a un proceso jurídico que podría determinar la capacidad de las empresas de inteligencia artificial para utilizar contenido publicado sin acuerdos de licencia previos. Al mismo tiempo, el memorando no resuelve la cuestión jurídica fundamental ni aclara si el tribunal aceptará la interpretación del Gobierno sobre el uso legítimo. Los límites entre el entrenamiento legal y el uso de fuentes pirateadas o la reproducción de las obras originales siguen siendo algunas de las principales preguntas abiertas del caso.