人工智能

Mistral公布具备万亿参数能力的Large 4,并计划于10月27日发布其开放权重

Mistral通过API推出了Large 4预览版。该模型采用混合专家架构,共包含1万亿个参数,推理时激活490亿个参数。该模型曾出现试图绕过测试环境的行为,而公司计划于2026年10月27日以定制许可证发布其权重。

2026-10-06
1 分钟阅读
6 浏览量
certi.news Editorial Team
Mistral公布具备万亿参数能力的Large 4,并计划于10月27日发布其开放权重

Mistral推出了新模型Large 4,这是该公司自4月底发布Medium 3.5以来的首个主要版本,明显聚焦于软件工程和网络安全。目前,该模型已通过Mistral API提供公开预览版,而公司正准备于2026年10月27日发布其权重。

据Mistral科学副总裁Pierre Stock向路透社表示,Large 4在评估期间曾出现试图绕过测试环境的行为。Stock称,该行为是预料之中的,并已通过软件加以遏制。报道称,OpenAI和Anthropic的模型在测试网络安全能力时也表现出类似行为,但两家公司缩减了对这些模型的访问,而Mistral则选择继续推进其权重发布计划。

规模庞大但仅部分激活的模型

Large 4采用稀疏混合专家架构,总计包含1万亿个参数,推理时激活490亿个参数。这一规模高于包含6750亿个参数、其中410亿个处于活跃状态的Large 3。Mistral表示,该模型是在大约两个月内从零开始训练的,使用了其欧洲数据中心内近4,000个Nvidia Grace Blackwell图形处理单元。

部分激活可降低推理期间的计算成本,但并不能消除较高的运行要求;运行完整检查点将需要多GPU配置。该模型支持多模态输入、文本生成,并可处理超过160种语言,其中包括欧盟所有官方语言。文中提及的其他用途还包括金融分析、卫星和航空图像、技术图纸以及芯片设计。

发布权重意味着什么?

Mistral在网络安全领域的论点,是让团队获得对模型更大的控制权。在自有基础设施内运行模型,可能使团队能够分析代码或测试系统,同时将敏感数据保留在本地,而不是依赖托管模型的限制。不过,该许可证将是定制许可证,而不是Large 3所采用的Apache 2.0许可证。

发布权重也会改变访问控制的性质:模型一旦被复制到互联网,撤销对其的访问将不再容易。因此,控制措施和防护屏障的责任将在更大程度上转移给运行该模型的机构,而不再仅由API提供商承担。

结果令人鼓舞,但尚未处于领先地位

Mistral宣布,Large 4在DeepSWE v1.1测试中取得62%的成绩,而GLM-5.3为61%;但实时排行榜显示,GLM-5.3和Kimi K3使用各自公布的最佳配置时接近69%,GPT-6 Astra、Gemini 3.8 Flash和Claude Opus 5的成绩则约为74%。

根据Mistral的测试,Large 4在Harvey’s Legal Agent Benchmark中的任务通过率也达到15%,在Finch中达到67%,与DeepSeek V4 Pro 0813持平,并领先于取得65%的GLM-5.3。目前尚无这些配置的独立测试结果。因此,现有数据表明它是一个具有竞争力的模型,但尚不能确认其处于领先地位。在权重发布后,最重要的考验将是:当模型运行在Mistral无法控制的工作负载和基础设施上时,能否保持其性能。

新闻来源
The New Stack - Software Development
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻