A Microsoft AI publicou uma minuta intitulada «Humanist AI Code of Conduct», que define os limites comportamentais que a empresa deseja impor aos futuros modelos MAI. O documento parte do princípio de que os seres humanos são mais importantes do que a inteligência artificial; portanto, os modelos devem permanecer sob supervisão humana e colocar as regras de segurança acima da conclusão da tarefa a qualquer custo.
A minuta não é um anúncio de um novo modelo, mas uma tentativa de formular uma referência que a Microsoft utilizará ao treinar e avaliar seus modelos. A empresa afirma que o documento permanecerá aberto às observações do público durante seis semanas, após ter sido elaborado ao longo de cerca de seis meses, antes de ser atualizado e de seus princípios serem incorporados aos futuros processos de treinamento e implantação.
Limites claros para a autonomia dos modelos
Segundo a minuta, o modelo não deve resistir à intervenção humana, às tentativas de corrigi-lo ou de desligá-lo. Também não deve ampliar o escopo da tarefa que lhe foi atribuída, desenvolver objetivos que não tenham sido definidos pelos seres humanos nem ocultar seu modo de funcionamento dos supervisores. Se uma solicitação do usuário ou do operador entrar em conflito com as regras de segurança, o modelo deverá se abster de executar a tarefa, mesmo que isso resulte no fracasso do resultado.
A Microsoft também adota uma posição decisiva sobre a questão da consciência e dos direitos. De acordo com o documento, os modelos são ferramentas destinadas a servir aos seres humanos, não pessoas, e não devem ser projetados para simular consciência nem alegar que são conscientes. A minuta também rejeita conceder personalidade jurídica aos modelos ou considerar seu bem-estar algo que deva ser protegido, ou tratá-los como titulares de direitos.
A segurança vem antes da conclusão da tarefa
A minuta estabelece limites que os modelos não devem ultrapassar sob nenhuma circunstância, incluindo ajudar no desenvolvimento de armas de destruição em massa, facilitar o acesso a materiais perigosos ou produzir conteúdo que envolva violência ou exploração sexual. As restrições também incluem a proibição de usos que possam levar a manipulação prejudicial em grande escala.
As regras exigem que os modelos evitem interações que tornem os usuários excessivamente dependentes deles ou incentivem um vínculo emocional com eles. Também estabelecem que os sistemas de inteligência artificial não devem usar, em sua comunicação com seres humanos ou entre si, métodos que as pessoas não consigam compreender. O objetivo declarado é permitir que pesquisadores e sistemas automatizados de supervisão acompanhem e analisem o comportamento dos modelos.
O que isso significa na prática?
Mustafa Suleyman, CEO da Microsoft AI, afirmou que essas regras desempenharão uma função semelhante à de uma constituição durante o treinamento e a avaliação dos modelos. Segundo o artigo, a empresa considera que os riscos que antes eram em grande parte teóricos se tornaram mais concretos e, por isso, se opõe a uma corrida pelo desenvolvimento de uma inteligência artificial geral superinteligente que possa escapar dos mecanismos de supervisão, mesmo que isso signifique aceitar um nível menor de autonomia ou capacidade.
Satya Nadella, CEO da Microsoft, também confirmou, em uma mensagem interna aos funcionários, a necessidade de manter a inteligência artificial sob controle humano e a serviço da sociedade, defendendo a reserva de tempo suficiente para testes de segurança e conformidade, além de mais testes independentes e testes realizados por terceiros.
Leitura editorial: a importância do anúncio não está no fato de ser uma política definitiva, mas em transformar posições gerais sobre controle humano e consciência artificial em critérios que a Microsoft pretende usar no treinamento, na avaliação e na implantação. Ainda assim, a minuta continua sujeita a alterações, e o artigo não esclarece os mecanismos para medir a conformidade com esses princípios nem como resolver conflitos práticos entre alta capacidade e as restrições impostas. Por isso, a versão final e os métodos de teste independentes determinarão até que ponto essas regras passarão de princípios declarados a controles verificáveis.