法国公司 Mistral 宣布推出新模型 Mistral Large 4,该模型的昵称为 Le Chonk。公司称,该模型能够与美国和中国最优秀的闭源人工智能模型竞争。该模型拥有万亿参数,目前以开放权重预览版提供,企业和开发者可以使用并定制它;最终版本预计将在 2026 年 10 月底前发布。
侧重行业领域的通用模型
Le Chonk 的设计目标是与领先的通用模型竞争,但尤其面向编程和网络防御,以及制造、金融、电气工程等应用领域。Mistral 认为,这些行业为其提供了脱颖而出的空间,因为大型人工智能实验室并未同等程度地关注所有专业领域。
该公司将这一模型描述为中国以外机构开发的最强开放权重模型,并称其与部分商业闭源模型的水平已非常接近。公司还强调,该模型从零开始训练,以区别于针对中国实验室的批评:后者被指使用蒸馏技术,根据大型模型的输出训练更小的模型。
实际发生了哪些变化?
最重要的影响不仅与模型规模有关,还与其权重可供运行和定制有关。开放模型的运行成本主要取决于消耗的计算能力,而不是向外部供应商支付由其设定的闭源模型访问费用。随着与商业模型之间的性能差距缩小,对于需要控制数据或使模型适应自身流程的企业而言,采用开放模型可能更具吸引力。
但原文没有提供独立测试结果或详细的对比指标,来证明其与最佳闭源模型达到同等水平的说法。此外,目前可用版本仍处于试验阶段,因此最终版本的质量以及运行如此大规模模型所需的条件仍是未解问题。
围绕主权与访问权的竞争
这一举措发布之际,外界越来越担心机构依赖那些可能因供应商或政府决定而改变访问权限的模型。文章称,美国总统唐纳德·特朗普政府在 6 月以担心相关模型被用于发动先进网络攻击为由,对 OpenAI 和 Anthropic 的模型分发实施了临时限制;此外,还有报道称,有人要求阻止英国人工智能安全研究所访问甚至尚未公开的模型。
这一背景为 Mistral 在欧洲提供了战略机遇,尤其是在欧盟寻求加强技术主权、跨大西洋关系趋于紧张之际。该公司还依托自身的商业扩张:公司在 9 月筹集了 33 亿美元,完成了一轮估值为 240 亿美元的融资;另据报道,其收入在过去一年中增长了约 20 倍。
certi.news 解读
如果最终版本能够维持已公布的性能水平,Le Chonk 可能会成为希望获得先进模型、同时拥有更强控制与定制能力的机构的重要选择,尤其适用于编程、网络安全和工程领域。不过,开放权重并不能消除基础设施、运行和治理方面的挑战,也不能单凭这一点证明该模型实际上优于闭源替代方案。其实际价值将取决于独立测试的发布、许可方面更明确的细节、部署要求,以及模型在专业任务中的表现。