观点与分析

Garry Tan呼吁美国人工智能实验室对前沿模型进行蒸馏

Y Combinator首席执行官Garry Tan认为,开发开放权重模型的美国较小型实验室应能够在美国先进模型上使用模型蒸馏技术,而不是将这一途径单独留给中国实验室。他将此视为维持封闭商业模型与开放模型之间平衡的一种方式,同时拒绝使用被盗凭证或欺诈手段。

2026-09-11
1 分钟阅读
8 浏览量
فريق تحرير certi.news
Garry Tan呼吁美国人工智能实验室对前沿模型进行蒸馏

Y Combinator首席执行官Garry Tan认为,美国可能需要允许较小型人工智能实验室从美国先进模型中蒸馏知识,以构建更强大、且不依赖中国实验室的一系列开放权重模型。此番立场提出之际,Anthropic正指控中国实验室对先进模型实施非法蒸馏攻击。

在接受CNBC采访时,Tan表示,他不会通过监管手段干预中国实验室使用蒸馏技术,但提出了建立“美国蒸馏体系”的可能性。他向TechCrunch解释说,这意味着允许开发开放权重模型的美国实验室使用这些技术,在明确的访问条件下“从正门”接触目标模型,而不是通过冒充身份、欺诈或窃取凭证的方式。

什么是模型蒸馏?

模型蒸馏是利用另一个模型的输出训练新模型,通常包括向其发送大量请求,并分析其回答和推理方式。人工智能实验室会在一些训练和模型改进场景中合法使用这项技术,但当目标模型未经授权被访问,或使用方隐瞒身份时,其使用边界就会引发争议。

据本文称,Anthropic本周发布了第二份报告,指控中国实验室实施“非法蒸馏攻击”。该公司称,这些行动包括隐藏身份,以及依靠欺诈和被盗凭证访问模型。Anthropic首席执行官Dario Amodei此前曾公开呼吁美国监管机构对这类蒸馏采取更严格的措施。

Tan为何提出不同立场?

Tan的论点并不局限于美国与中国之间的竞争。他认为,人工智能实验室不应拥有广泛权力,去控制客户如何使用其通过应用程序接口获得的信息。在他看来,对封闭模型输出的使用施加严格限制,可能会削弱研究人员和开发者构建开放替代方案的能力。

Tan还将这一立场与商业模型自身的训练历史联系起来。他指出,封闭模型实验室收集了大量广泛可获得的人类知识来训练其系统,其中包括受版权保护的材料,而且并不总是获得知识产权所有者的许可。因此,他认为,获取基于广泛公共数据训练出的智能,其性质应更接近公共利益,而不应完全受制于私营公司规定的服务条款。

实际会发生什么变化?

如果这一想法转化为政策,争论焦点将围绕访问条件、使用边界以及证明目标模型已同意使用,而不是允许任何形式的模型复制。Tan对获授权蒸馏与基于凭证盗窃的蒸馏所作的区分十分重要;他并不是在为Anthropic归因于中国实验室的行动辩护,而是在主张为较小型美国实验室提供合法使用先进模型输出的机会。

对于开放权重模型开发者而言,这种方式可能缩小他们与那些拥有从零开始开发前沿模型所需资本、研究人员和基础设施的实验室之间的资源差距。而先进商业实验室可能会将其视为对封闭模型价值,以及其控制接口和输出使用方式的能力的威胁。

观点与事实

Tan将自己的立场描述为维护人工智能市场多元化的一种方式。他警告说,可能出现这样的情形:一家拥有最佳资本渠道和最佳研究人员的公司成为拥有最强模型的企业,并成为先进能力的唯一入口。他认为,开放权重模型能够为用户提供更大的自由和更广泛的访问,而先进实验室则能确保继续投资开发新能力。

但本文没有提供证据表明美国已就此类“蒸馏体系”达成监管共识,也没有解决知识产权、合同条款或验证授权使用方式等问题。因此,Tan的提议仍是这场讨论中的一种政策和思想立场;这场讨论交织着经济安全、企业权利、研究人员利益以及模型滥用风险,而不是一项已经生效的政策声明。

新闻来源
TechCrunch AI
查看原始来源 ↗
ف
作者

فريق تحرير certi.news

同一分类

你可能还喜欢

查看所有新闻