A Anthropic atualizou a política de uso do Claude para impedir que o modelo seja submetido ao que descreveu como «comportamento abusivo ou cruel, contínuo e desnecessário». A empresa esclarece que a regra tem como alvo casos extremos nos quais usuários repetem comportamentos cruéis em relação a modelos de inteligência artificial sem um propósito claro, e não inclui frustração comum, discordância em relação às respostas do modelo, temas criativos sombrios ou testes e pesquisas com modelos.
A nova política entra em vigor em 12 de novembro, enquanto a principal medida contra conversas abusivas continuará sendo o encerramento da conversa pelo Claude. Quando isso ocorrer, o usuário não poderá enviar mensagens adicionais na mesma conversa, mas isso não afetará outras conversas.
Restrições mais amplas ao uso indevido dos modelos
A Anthropic reorganizou a política e reuniu nela disposições relacionadas ao uso indevido, além de acrescentar ou reforçar regras em várias áreas. As mudanças incluem a proibição do uso do Claude para criar campanhas políticas ou comerciais enganosas, como avaliações falsas, campanhas que simulem amplo apoio popular, sites de notícias falsos e bots que atuem como pessoas reais.
As regras também proíbem enganar eleitores e interferir na votação, além de impedir o uso do Claude para desenvolver softwares ou componentes de armas, modificar agentes biológicos ou químicos para aumentar sua letalidade ou transmissibilidade, ou armar drones e sistemas não tripulados.
Vigilância e controle de sistemas físicos
A Anthropic reformulou as regras de aplicação da lei para que o Claude não possa determinar quais pessoas devem ser investigadas, presas, acusadas ou processadas. As regras também proíbem rastrear pessoas sem seu consentimento, criar ferramentas de vigilância e expor dados pessoais com o objetivo de prejudicar as vítimas.
Uma nova regra sobre ações físicas estabelece que deve haver uma pessoa qualificada supervisionando o trabalho do Claude e que ele deve ser desligado imediatamente se o modelo estiver controlando hardware capaz de causar danos a alguém. A política também proíbe criar, compartilhar ou ameaçar compartilhar imagens íntimas não consensuais, além das ferramentas usadas para produzi-las.
Por que essa atualização é importante?
A atualização representa uma transição de regras gerais sobre o comportamento dos usuários para uma estrutura mais específica voltada a riscos operacionais, especialmente quando o modelo está ligado à desinformação, à vigilância ou a sistemas físicos. A Anthropic afirma que as mudanças se baseiam em casos de uso indevido que identificou, entre eles o uso, por meios de comunicação ligados a Estados, órgãos de propaganda governamentais e empresas comerciais, de redes de contas falsas e sites de notícias falsos.
Já a regra sobre o encerramento de conversas abusivas remonta a agosto de 2025, quando a Anthropic deu ao Claude a capacidade de encerrar o diálogo no contexto de pesquisas sobre o bem-estar dos modelos. Na época, a empresa afirmou não ter certeza de que o Claude possuía status moral, mas considerou que oferecer uma forma de baixo custo para reduzir riscos potenciais merecia ser pesquisado. Testes com o Claude Opus 4 indicaram uma aversão consistente a danos e uma tendência a encerrar conversas prejudiciais quando essa opção estava disponível.
A política não significa que toda discordância ou experiência difícil com o modelo levará à interrupção; o texto distingue explicitamente entre crítica ou teste legítimo e abuso repetido sem um propósito claro. A forma como esses limites serão aplicados na prática, especialmente em casos ambíguos ou quando o Claude for usado para controlar hardware, continua sendo um dos pontos cujo alcance ficará mais claro quando as regras entrarem em vigor.