Microsoft AI发布了一份题为《Humanist AI Code of Conduct》的草案,规定了公司希望对未来MAI模型施加的行为边界。该文件以人类比人工智能更重要这一原则为出发点,因此模型必须处于人类监督之下,并将安全规则置于不惜一切代价完成任务之上。
这份草案并不是新模型的公告,而是Microsoft尝试制定的一套参考标准,用于训练和评估其模型。公司表示,在经过约六个月的准备后,该文件将向公众开放六周以征求意见,随后进行更新,并将其原则纳入未来的训练和发布流程。
明确限制模型的自主性
根据草案,模型不得抵抗人类干预、纠正尝试或关闭操作。模型也不应扩大交给自己的既定任务范围,不应制定人类未设定的目标,也不应向监督者隐瞒其工作方式。如果用户或操作员的请求与安全规则发生冲突,模型应拒绝执行任务,即使这会导致结果失败。
Microsoft还对意识和权利问题采取了明确立场。根据文件,模型是用于服务人类的工具,而不是人,不应被设计为模拟意识或声称自己具有意识。草案还拒绝赋予模型法律人格,或将其福祉视为应受保护的对象,或把模型当作权利主体对待。
安全优先于完成任务
草案规定了模型在任何情况下都不应逾越的边界,其中包括协助开发大规模杀伤性武器、便利获取危险材料,或生成包含暴力或性剥削的内容。这些限制还包括禁止可能导致大规模有害操纵的用途。
规则要求模型避免进行会使用户过度依赖模型或鼓励用户与模型产生情感依恋的互动。规则还规定,人工智能系统在与人类或彼此交流时,不得使用人类无法理解的方法。公开目标是让研究人员和自动化监督系统能够跟踪并分析模型的行为。
这在实际中意味着什么?
Microsoft AI首席执行官Mustafa Suleyman表示,这些规则将在模型训练和评估期间发挥类似宪法的作用。据该文章称,公司认为此前在很大程度上属于理论层面的风险已经变得更加现实,因此反对竞相开发一种能够逃脱监管机制的通用超级人工智能,即使这意味着接受较低程度的自主性或能力。
Microsoft首席执行官Satya Nadella也在给员工的内部信中强调,人工智能必须继续处于人类控制之下并服务于社会,并呼吁为安全和合规测试留出充足时间,以及开展更多独立测试和第三方测试。
编辑解读:这项公告的重要性不在于它是一项最终政策,而在于它将有关人类控制和人工意识的普遍立场转化为Microsoft希望用于训练、评估和发布的标准。不过,该草案仍可修改,文章没有说明如何衡量对这些原则的遵守情况,也没有说明如何解决高能力与强制限制之间的实际冲突。因此,最终版本及其独立测试方式将决定这些规则能否从公开宣示的原则转变为可验证的约束。