免费提供先进人工智能模型,并不意味着其开发成本低廉。开放权重模型需要在数据、硬件和计算能力方面进行大量投资,但发布模型可能服务于超越模型本身销售的商业和战略目标。这是ITmedia AI Plus于2026年9月10日在一篇关于本地语言模型繁荣的系列报道中发布的分析所得出的主要结论。
该分析将本地模型的普及与三个相互交织的因素联系起来:模型、硬件和软件的成熟;对完全依赖云端人工智能服务的担忧加剧;以及企业和国家围绕开放模型生态系统塑造权展开的竞争。
开放模型作为销售硬件的手段
据文章称,NVIDIA押注于这样一种判断:拥有能够在机构内部运行的强大模型,是将图形处理单元市场扩展到少数几家大型云计算公司之外的基本条件,这些公司包括 Microsoft、Google、Amazon 和 Meta。
该公司提出了AI Factory概念,其基础是机构拥有自己的 GPU 服务器,并利用自身数据生成服务于业务的人工智能输出。但如果最好的模型始终只能通过封闭 API 提供,这一模式的吸引力就会降低;届时,企业购买的将是服务访问权,而硬件采购在很大程度上仍将局限于云服务提供商。
因此,NVIDIA 正在开发Nemotron系列,并以开放形式发布模型权重、数据集和训练配方。公司还在2026年3月的 GTC 大会上宣布成立Nemotron Coalition,共有八家公司参与,其中包括 Mistral AI、Perplexity、Cursor 和 Thinking Machines Lab。据消息源称,该联盟的首个项目将是由 NVIDIA 与 Mistral AI 合作开发的基础模型。
免费模型是通往云服务的入口
该分析将Alibaba Cloud的战略描述为一种执行方式不同但目标相似的模式。公司保留最高级别的Qwen Max模型并将其设为封闭模型,以通过 API 和云服务实现收入,同时免费提供其他模型,并采用允许商业使用的许可。
这里的赌注,是把免费模型转化为 Alibaba Cloud 生态系统的分发渠道。机构可能在自身环境中进行微调,但日后可能需要外部基础设施,以大规模提供推理服务。届时,IaaS 和 PaaS 服务,以及 Model as a Service,都可能成为实现收入的路径。
文章提到,截至2026年4月,Qwen 模型的累计下载量已超过10亿次。实际上,这些数字意味着,模型的价值不仅取决于其直接价格,也取决于其构建用户基础并随后推动计算和云服务消费的能力。
从商业竞争到国家战略
该分析认为,模型开放同样与地缘政治竞争有关。美国的出口限制削弱了中国企业获得最新 GPU 单元的能力,使其难以仅凭计算资源规模与美国封闭模型企业竞争。另一方面,大范围发布模型权重能够建立开发者生态并实现全球传播,而一旦开放,这种影响就很难逆转。
消息源指出,美国政府于2025年7月公布了人工智能行动计划,其中包括将开源或开放权重人工智能视为具有地缘政治价值。2026年7月,包括 NVIDIA、Microsoft、Meta、IBM、Hugging Face、Mistral AI 和 Palantir 在内的企业签署了一封信,呼吁发布开放权重模型,而不是通过限制其传播来监管这些模型;据文章称,OpenAI 和 Google 随后也加入其中。8月,相关企业获悉一项政策:美国开放权重模型可免于接受政府事先的安全审查。
这对机构实际意味着什么?
该分析并未得出机构将放弃云端模型的结论。相反,它建议根据任务性质分配使用方式:对于需要最高能力水平的任务,使用先进云端模型;对于不能移出机构的数据或无法承受中断的流程,使用本地模型;对于需要以低于顶级模型的成本获得良好性能的任务,则使用托管开放模型的云服务。
从这个角度看,运行本地模型不仅是一个技术选择,也是谈判筹码和业务连续性工具。不过,仍有一些限制和悬而未决的问题:模型的可用性或其条款可能发生变化,访问封闭模型的能力可能中断,而且拥有模型权重并不能消除运行和管理成本。因此,正如作者所阐述的那样,开放模型的价值在于扩大控制空间和灵活性,而不是始终提供优于封闭云服务的替代方案。