人工智能

推动本地语言模型崛起的三个因素:模型、硬件和软件的成熟

ITmedia认为,人们日益关注在本地运行大型语言模型,并不仅仅是因为对依赖云服务的担忧,更是因为三个要素日趋成熟:开放权重模型、硬件以及软件。该系列第一部分聚焦于模型的发展,其中DeepSeek、Qwen及其他中国模型日益受到关注。

2026-09-08
1 分钟阅读
9 浏览量
certi.news
推动本地语言模型崛起的三个因素:模型、硬件和软件的成熟

ITmedia于2026年9月8日刊发的一篇分析认为,本地大型语言模型(Local LLM)受到关注的浪潮,建立在三个同步成熟的要素之上:开放权重模型、能够运行这些模型的硬件,以及利用这些模型所需的软件。这一趋势出现之际,人们开始更加明显地认识到依赖云端人工智能服务的局限性。

什么是本地语言模型?

文章将本地模型定义为一种可以在个人设备或工作站上运行的开放权重大型语言模型。借助权重文件和推理引擎,即使在没有互联网连接的情况下,也可以下载并运行模型。因此,使用过程不完全取决于云服务是否持续运行,也不完全取决于服务提供商对账户或访问权限的决定。

ITmedia指出,这一因素在2026年变得更加重要,因为与云端人工智能服务相关的事件表明,访问权限可能会突然中断。文章列举了服务中断或账户被停用的风险等例子,但同时强调,仅用这些担忧来解释本地模型的崛起,将是过度简化。

第一个条件:能力更强的开放权重模型

文章讨论的第一个要素,是开放权重模型的快速发展。文章引用了其所称的“DeepSeek冲击”:2025年1月,中国DeepSeek公司推出DeepSeek R1模型,该模型被认为在部分领域接近OpenAI的o1模型性能,同时以开放权重形式免费提供。当时还广泛流传着相关信息,称该模型训练时使用的图形处理器数量少于OpenAI和Google等公司,这促使NVIDIA股价一度下跌。

文章还重点介绍了Alibaba Cloud旗下的Qwen系列。该系列在2025年7月和8月推出开放权重的Qwen3版本后获得了发展势头。根据分析,其优势在于覆盖范围广,从可以在智能手机上运行的小型模型,到面向消费级图形处理器的中型模型,以及需要GPU服务器的大型模型。2026年8月发布的Qwen3.8-27B也受到了广泛关注,原因是有说法称其性能可与Claude Opus 4.6相媲美。

文章还提到其他中国大型模型,包括Z.ai的GLM-5.3、Moonshot AI的Kimi K3和MiniMax的MiniMax M3;此外还提到了Google、NVIDIA和Meta推出的中小型模型,以及Preferred Networks、SB Intuitions和隶属于日本国立信息学研究所的LLM-jp推出的日本项目。

为什么这一发展很重要?

实际变化并不只是免费模型的出现,而是可在不同设备上运行的模型范围扩大了,从手机到工作站和服务器均可覆盖。这为需要在隐私、对云服务提供商的依赖、响应时间和运行成本之间进行权衡的机构提供了更多选择。

但文章并未断言本地运行始终是更好的替代方案。目前可见的部分主要讨论模型这一条件,并在结尾转向将“统一内存”作为下一部分的主题;与此同时,运行成本、使用方式以及供应商和国家所扮演的角色,都不在本部分范围内。因此,根据现有信息,本地模型的崛起是模型、硬件和软件共同发展的结果,而不仅仅是对云服务风险的反应。

新闻来源
ITmedia AI Plus Japan
查看原始来源 ↗
c
作者

certi.news

同一分类

你可能还喜欢

查看所有新闻