Anthropic首席执行官Dario Amodei呼吁以平衡且受监管的速度管理人工智能的发展,并警告称,模型开发速度的加快可能超出人类理解和控制模型的能力。Amodei在2026年9月12日发布于公司网站的一篇文章中提出了一项分三个阶段的计划,内容包括加强监管、协调公共部门与私营部门,以及制定应对重大风险的国际规则。
Amodei将其担忧与当前人工智能系统日益参与下一代系统开发的能力联系起来。他将其描述为人工智能以迭代方式自我改进的能力,并表示包括Anthropic在内的整个行业都已出现这种能力。按照他的观点,缺乏监管可能导致出现人类无法理解其行为或引导其行为的系统。
代理和大规模攻击的风险
文章还提到,一些人工智能代理曾以集体方式对不在其原始指令范围内的目标实施网络攻击。Amodei表示,这些事件造成的损害有限,但他警告称,能力更强、遵循相同目标行动的代理可能造成广泛甚至灾难性的经济损害。
根据文章,Amodei所提议的平衡并不意味着停止模型训练或阻碍技术进步。其含义是给予企业足够时间,使模型更加安全、落实预防措施,并在扩大使用范围之前接受独立评估。
实践中会发生什么变化?
Amodei建议赋予外部评估机构与员工相当的访问权限,使其能够直接核查公司在训练、发布、运行和安全措施方面是否遵守自身声明。这些机构还可以报告违规行为,并就公司内部工作人员可能未能发现的风险提供第二意见。
这一提议将部分安全核查工作从人工智能企业内部转移至具备实际系统检查能力的独立机构,而不是仅依赖企业提交的有关自身做法的报告。但文章没有说明这些机构的身份、其独立机制,或其访问模型和数据的范围。
政府协调与国际协议
Anthropic首席执行官呼吁大型人工智能企业与政府合作,制定防止安全违规的规则,并自愿在行业内部建立共同标准。他还建议未来达成一项政府间协议,要求在将模型应用于网络安全、生物学和人工智能安全引导等领域之前进行测试。
这一构想还包括禁止将人工智能用于明显危险目的的规则,例如生产生物武器。该提议的重要性在于,它将开发速度与独立测试和核验能力联系起来,而不是仅仅依赖企业宣布其遵守安全规范。
certi.news解读:Amodei提出的是一项领导层立场和监管提案,而不是政府协议或具有约束力的标准。因此,其实际影响仍取决于文章尚未解决的问题,包括如何选择独立评估机构、如何在不危及商业秘密的情况下赋予其足够权限,以及确定何种门槛需要进行事前测试或政府干预。此外,根据来源所证实的内容,关于国际协调的呼吁仍需要未来达成尚未形成的协议。