A administração do presidente americano Donald Trump apresentou ao tribunal um memorando de 20 páginas em apoio à posição da OpenAI na ação movida pelo The New York Times, que argumenta que o uso não autorizado de materiais protegidos por direitos autorais para treinar modelos de linguagem de grande escala é ilegal. O memorando defende a continuidade desse uso, considerando-o importante para preservar a competitividade dos Estados Unidos no campo da inteligência artificial.
O memorando afirma que os Estados Unidos têm “um forte interesse em continuar desenvolvendo uma indústria de inteligência artificial robusta e competitiva, que estabeleça os padrões globais para a prática e os procedimentos de inteligência artificial”. Também relaciona essa posição a uma ordem executiva assinada por Trump no ano passado, que pede a preservação da liderança global dos Estados Unidos em inteligência artificial.
O cerne da disputa: o treinamento é uso justo?
Modelos como ChatGPT, Claude e Gemini dependem de enormes bancos de dados que incluem livros, artigos e obras de mídia publicadas. As empresas de inteligência artificial afirmam que treinar modelos com essas obras pode se enquadrar no princípio do “uso justo” previsto na lei de direitos autorais, uma exceção que permite, em determinadas circunstâncias, o uso de obras de terceiros sem licença.
Mas a aplicação desse princípio ao treinamento de inteligência artificial continua sendo objeto de amplo debate jurídico. A discussão se concentra especialmente em saber se o uso das obras no treinamento é suficientemente “transformador”, ou seja, se produz uma função ou resultados diferentes das obras originais, em vez de copiá-las ou substituí-las.
O memorando da administração americana alerta que restringir o desenvolvimento de modelos de linguagem de grande escala devido ao que descreve como uma incompreensão do princípio do uso justo pode dificultar o progresso criativo e científico, além de prejudicar a prosperidade e a mobilidade econômica nos Estados Unidos.
O que a intervenção do governo muda?
O memorando não é uma decisão judicial, e o órgão que o preparou não tem autoridade para decidir a ação. O caso é analisado pelo Tribunal Distrital dos Estados Unidos para o Distrito Sul de Nova York; portanto, a decisão final continua nas mãos do tribunal. Ainda assim, a intervenção da administração representa uma posição oficial do governo que pode acrescentar peso político e jurídico aos argumentos da OpenAI, em um momento em que editoras e escritores tentam definir os limites do uso de suas obras no treinamento de modelos.
Os precedentes do caso indicam que os resultados das ações relacionadas ao treinamento de inteligência artificial e aos direitos autorais têm sido, até agora, em grande medida favoráveis às empresas de inteligência artificial. No ano passado, o juiz William Alsup ordenou que a Anthropic pagasse um acordo de US$ 1,5 bilhão a um grupo de escritores, mas a penalidade não estava relacionada ao treinamento dos modelos de inteligência artificial em si, e sim ao uso de bibliotecas-sombra ilegais para piratear os livros utilizados no treinamento.
Alsup comparou o treinamento dos modelos da Anthropic à leitura humana de um livro com o objetivo de se tornar escritor, afirmando que os modelos foram treinados com as obras não para competir com elas ou substituí-las, mas para seguir em uma direção diferente e produzir algo novo.
Por que esta notícia é importante?
O desenvolvimento confirma que a disputa em torno dos dados de treinamento não diz respeito a uma única empresa, mas a um caminho jurídico que pode determinar a capacidade das empresas de inteligência artificial de usar conteúdo publicado sem acordos prévios de licenciamento. Por outro lado, o memorando não resolve a questão jurídica fundamental nem esclarece se o tribunal aceitará a interpretação do governo sobre o uso justo. Os limites da diferença entre treinamento legítimo, uso de fontes pirateadas e reprodução das obras originais continuam sendo algumas das principais questões em aberto no caso.