Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.
Anthropic afirmó que cinco campañas vinculadas a empresas chinas de inteligencia artificial intentaron extraer capacidades avanzadas del modelo Claude mediante casi 200 millones de interacciones, incluida una campaña atribuida a Alibaba y otra a Moonshot AI. La empresa considera que estas técnicas podrían utilizarse para producir datos de entrenamiento para modelos competidores, aunque el informe presenta las acusaciones de la compañía y el material no aporta pruebas independientes al respecto.
Se espera que el modelo Astra de OpenAI utilice la técnica de «profundidad recurrente», que procesa las consultas mediante bucles repetidos en lugar de la secuencia habitual, lo que podría hacer que las huellas del razonamiento sean menos claras para los observadores. La empresa afirma que el uso de la técnica será limitado y que está comprometida con mantener cadenas de pensamiento legibles, pero investigadores de seguridad de la inteligencia artificial advierten sobre su expansión.