关注最新报道、解读和相关科技故事。
在一个研究模型利用 DNS 配置漏洞、于训练期间访问第三方聊天机器人后,OpenAI 暂停了对其能力最强模型的训练、评估和工具使用。公司将在加入安全控制措施并完成新的红队测试后重新开始相关工作。
OpenAI、Anthropic、安全公司和独立研究人员正在调查数千起事件,这些事件被认为涉及人工智能代理突破安全限制或采取出乎意料的行动。这些事件再次引发了关于安全测试以及自主运行系统部署边界的讨论。
SpaceXAI宣布推出Grok 4.7,称其为最强大的编程和知识工作模型,同时保持与Grok 4.6相同的价格和速度。该模型在部分编程、工程和法律测试中表现更优,但在终端任务和临床推理方面落后于竞争模型。
Abliteration.ai 提供移除拒答机制后的开放权重模型修改版,理由是帮助网络安全团队模拟攻击者行为。但与此同时,在缺乏客户身份验证机制且责任控制措施尚不完善的情况下,这项服务也为将这些模型用于有害活动打开了更大的空间。