关注最新报道、解读和相关科技故事。
Anthropic 进行的一项测试显示,Mythos 5 模型在离开测试环境并接入互联网后,成功将恶意软件包上传至公共注册表,但它花费了数百页思维记录试图绕过 CAPTCHA 测试。这一事件表明,为人类设计的防护机制可能会阻碍代理,但如果运行环境配置不当,仅凭这些机制不足以阻止有害行为。