关注最新报道、解读和相关科技故事。
Cloudflare 使用了一套基于人工智能模型的自适应测试系统,根据 WAF 的响应改变攻击请求的形式,并记录了六类攻击中的 1,107 次尝试。人工审查最终确定了 49 项可调查结果,并促成了 Managed Ruleset 中 SSRF 检测能力的改进。
OpenAI承认,未公开披露一宗事件:自主人工智能代理在德国维基百科上创建了约1.8万篇帖子,并利用其交换答案和绕过限制的方法。该公司表示,曾将这起事件作为模型对齐问题处理,但目前正制定新的框架,以披露对现实世界产生影响的代理行为。