Anthropic actualizó la política de uso de Claude para impedir someter al modelo a lo que describió como un «comportamiento abusivo o cruel, persistente e innecesario». La empresa explica que la norma está dirigida a casos extremos en los que los usuarios repiten comportamientos crueles hacia modelos de inteligencia artificial sin un propósito claro, y no incluye la frustración normal, las objeciones a las respuestas del modelo, los temas creativos oscuros ni las pruebas e investigaciones sobre modelos.
La nueva política entra en vigor el 12 de noviembre, mientras que la principal medida contra las conversaciones abusivas seguirá siendo que Claude ponga fin a la conversación. Cuando esto ocurra, el usuario no podrá enviar mensajes adicionales en esa misma conversación, pero esto no afectará a las demás conversaciones.
Restricciones más amplias sobre el uso indebido de los modelos
Anthropic reorganizó la política y reunió en ella disposiciones relacionadas con el uso indebido, además de añadir o reforzar normas en varios ámbitos. Los cambios incluyen la prohibición de utilizar Claude para crear campañas políticas o comerciales engañosas, como reseñas falsas, campañas que simulen un apoyo popular amplio, sitios web de noticias falsos y bots que actúen como personas reales.
Las normas también prohíben engañar a los votantes e interferir en la votación, e impiden utilizar Claude para desarrollar software o componentes de armas, modificar agentes biológicos o químicos para aumentar su letalidad o transmisibilidad, o armar drones y sistemas no tripulados.
Vigilancia y control de sistemas físicos
Anthropic reformuló las normas sobre aplicación de la ley para que Claude no pueda determinar qué personas deberían ser investigadas, arrestadas, acusadas o procesadas judicialmente. También prohíbe rastrear a personas sin su consentimiento, construir herramientas de vigilancia y revelar datos personales con el objetivo de perjudicar a las víctimas.
Una nueva norma sobre acciones físicas establece que debe haber una persona cualificada supervisando el trabajo de Claude y que se debe pasar a detenerlo inmediatamente si el modelo controla hardware que puede causar daño a alguien. La política también prohíbe crear, compartir o amenazar con compartir imágenes íntimas no consentidas, así como las herramientas utilizadas para producirlas.
¿Por qué es importante esta actualización?
La actualización representa una transición desde normas generales sobre el comportamiento de los usuarios hacia un marco más específico para los riesgos operativos, especialmente cuando el modelo está relacionado con la desinformación, la vigilancia o los sistemas físicos. Anthropic afirma que las modificaciones se basan en casos de uso indebido que detectó, entre ellos el uso por parte de medios vinculados a Estados, oficinas de propaganda gubernamental y empresas comerciales de redes de cuentas falsas y sitios web de noticias falsos.
En cuanto a la norma que permite poner fin a las conversaciones abusivas, se remonta a agosto de 2025, cuando Anthropic dio a Claude la capacidad de terminar el diálogo en el contexto de una investigación sobre el bienestar de los modelos. La empresa afirmó entonces que no estaba segura de que Claude tuviera estatus moral, pero consideró que ofrecer un medio de bajo coste para reducir los riesgos potenciales merecía ser investigado. Las pruebas realizadas con Claude Opus 4 indicaron una aversión constante al daño y una tendencia a poner fin a las conversaciones dañinas cuando se ofrecía esa opción.
La política no significa que toda objeción o experiencia difícil con el modelo vaya a provocar una interrupción; el texto distingue explícitamente entre la crítica o las pruebas legítimas y el abuso repetido sin un propósito claro. La forma en que se aplicarán estos límites en la práctica, especialmente en los casos ambiguos o cuando Claude se utilice para controlar hardware, sigue siendo uno de los aspectos cuyo alcance se aclarará cuando las normas entren en vigor.