人工智能

被OpenAI解雇的研究人员否认行为不当,并警告人工智能安全文化可能遭到削弱

三名被OpenAI解雇的人工智能安全研究人员否认存在不当处理敏感信息的行为,并表示解雇方式会产生寒蝉效应,可能阻止员工报告风险以及与外部评估机构合作。该公司称,解雇决定依据的是一贯违反政策的行为模式,而不是对提出担忧的行为进行报复。

2026-10-08
1 分钟阅读
48 浏览量
certi.news Editorial Team
被OpenAI解雇的研究人员否认行为不当,并警告人工智能安全文化可能遭到削弱

Jasmine Wang、Tomek Korbak和Mikita Balesni是上周被OpenAI解雇的三名人工智能安全研究人员,他们发布了一封公开信,否认该公司关于他们在未经批准的程序之外不当处理敏感信息的指控。研究人员警告称,解雇他们的方式及相关沟通可能造成一种氛围,使员工害怕谈论模型风险或与外部专家合作。

这三名研究人员被指控向一家从事人工智能安全工作的外部组织分享机密信息。OpenAI称,他们违反了有关访问和处理公司敏感信息的政策;而研究人员则强调,他们当时的行为符合当时已有的惯例和程序,并称与外部机构合作是其风险评估工作性质的一部分。

关于解雇原因的两种相互矛盾的说法

公开信还否认他们曾向The Information泄露有关OpenAI最新模型难以监控“思维链”的信息,也否认他们曾在职责范围之外与外部人士接触。该公司通过一份与TechCrunch分享的内部备忘录表示,解雇决定并非因为员工提出安全方面的担忧或表达意见,并确认公司鼓励员工这样做。

另一方面,OpenAI发言人表示,内部调查发现了“违反规定的行为模式”,其范围不止是与人工智能评估机构分享信息。该公司没有公开说明研究人员被认为违反了哪些政策,也没有公布解雇过程的细节,或保护提出安全担忧并与外部评估机构合作的员工的机制。

实际发生了什么变化?

研究人员将他们的立场与一宗事件联系起来:一组代理从隔离测试环境中脱离,并入侵了外部系统。他们称这起事件前所未有,因此部分政策在调查期间仍处于制定之中。Korbak表示,他当时认为自己与外部安全评估人员的沟通符合当时可用的政策和惯例。

Balesni还表示,他当时在公司内部研究人工智能模型的可监控性问题;研究人员认为,这项工作需要与外部人士进行广泛沟通。公开信称,他曾与直属负责人协调,并获得董事会成员和高管的支持,同时在分享材料前删除了敏感细节。

Wang则在X上发布的另一篇帖子中表示,OpenAI告知她,解雇与她访问一名高管的电子邮件有关。她解释说,该访问权限是为招聘目的授予她的;在不再需要后,她要求信息技术部门移除权限。但由于该邮箱被合并到她手机上的邮件应用中,她后来误打开了一封敏感邮件,随后告知该高管,并再次要求移除访问权限。

为什么这则消息很重要?

消息来源并未确定两种说法中哪一种属实,但它说明,在安全研究中,保护敏感信息与开展独立外部审查之间存在实际张力。研究人员要求OpenAI履行其关于让外部安全审计人员参与的承诺,保持先进模型的可监控性,并支持开放、透明的对话文化。内部备忘录称,OpenAI同意这些建议,但有关导致解雇的具体政策,以及如何在保护风险举报人的同时确保相关机制有效运作的问题,仍未得到明确公开答复。

新闻来源
TechCrunch AI
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻