人工智能

Anthropic 与 Accenture 启动公司内部人工智能模型评估合作

Anthropic 与 Accenture 合作,对先进人工智能模型开展独立评估和渗透测试,双方预计在五年内各自至少投资 10 亿美元。这项倡议揭示了一种新的监督模式,但在访问权限、资金和报告机制方面仍缺乏稳定标准。

2026-09-22
1 分钟阅读
4 浏览量
فريق تحرير certi.news
Anthropic 与 Accenture 启动公司内部人工智能模型评估合作

Anthropic 于 2026 年 9 月 18 日宣布与 Accenture 建立合作关系,对先进人工智能模型进行独立评估。此举旨在让独立评估人员进入模型开发公司内部,而不是仅在模型开发完成后进行外部审查。Accenture 旗下的专业人工智能部门 Faculty 将负责牵头这项合作。

合作范围包括模型评估、采用对抗性模拟方法进行测试、开展对齐评估以及检查防护措施。Anthropic 表示,Accenture 在企业和政府部署人工智能以及服务多个行业方面的经验,将为模型安全性及其使用评估加入实践视角。

双方预计,未来五年内将各自至少投资 10 亿美元,用于建设与这一领域相关的能力。公司没有在公告中说明支出时间表或衡量这些投资的机制。

嵌入式评估意味着什么?

嵌入式评估是指独立评估人员在人工智能公司内部工作,并获得接近员工级别的访问权限。这使他们能够在模型训练期间跟进模型,审查影响模型构建和部署的决策,并直接与负责相关工作的人员交流。Anthropic 表示,这一位置可能有助于评估人员核实公司是否履行安全承诺、发现薄弱环节、报告事故,并向公众提供一幅更充分了解相关收益和风险的图景。

Anthropic 强调,独立评估人员的存在不会将安全责任转移给其他方,也不会减轻其自身的问责责任;其模型的安全性仍由 Anthropic 直接负责。这项倡议的实际价值在于,通过对开发阶段和内部决策进行独立访问,使这项责任在更大程度上能够得到核验。

尚未解决的空白

目前还没有获得共识的标准来确定嵌入式评估人员应获取哪些信息,或他们应以何种方式提交结果。长期为独立评估提供资金的稳定制度同样尚未形成。Anthropic 认为,未来资金应来自汇集资金来源或政府,但由于这些替代方案目前尚不可用,现阶段将直接为 Accenture 的工作提供资金。

公司还在与 METR 及其他非营利机构进行讨论,计划利用自身资金试验嵌入式评估的部分要素。Anthropic 还宣布,与 Accenture 的合作并非排他性合作;公司将在未来几周宣布与其他评估人员开展合作,而 Accenture 也将与其他人工智能开发商合作。

certi.news 解读

这项公告的重要性在于,它将关于模型安全的讨论从独立的评估报告转向对开发过程本身的监督。这可能使评估人员更有能力发现早期决策和风险,但同时也提出了有关评估人员独立性、访问权限边界、信息保护机制以及结果发布方式的关键问题。鉴于 Anthropic 承认目前尚不存在稳定的标准或资金模式,这项合作更像是一项重要的奠基性试验,而不是最终的治理框架。

新闻来源
Anthropic Newsroom
查看原始来源 ↗
ف
作者

فريق تحرير certi.news

同一分类

你可能还喜欢

查看所有新闻