Mistral AIは、現時点で同社最大かつ最も高性能なモデルと位置付ける「Mistral Large 4」を発表した。内部では「Le Chonk」というコードネームで知られるこのモデルは、総計1兆パラメータを備え、各処理では490億のアクティブパラメータを使用する。同社はMistral Studioを通じてパブリックプレビューを提供し、10月末までにモデルの重みを公開する予定だ。
エンタープライズ用途向けマルチモーダルモデル
Mistral Large 4はテキストと画像を処理し、同社によれば、プログラミング、AIエージェントを基盤とするワークフロー、画像理解、金融、法務、サイバーセキュリティ向けに設計されている。Mistralは、オープンウェイトモデルと比較して、複数のエンタープライズシナリオで最高水準の性能を発揮すると主張している。
画像理解のDense 200テストでは、同モデルは42%を記録し、GPT-6 Astraの41%を上回った。また、複雑な文書、図表、技術図面を分析し、大規模な衛星画像内の特定要素を見つけ、視覚データ内の要素の位置を特定できるとしている。
セキュリティとプログラミングにおける性能指標
Mistral Large 4は、実際のソフトウェアに存在する脆弱性を再現したうえで修正を試みるテストで82%を達成し、40個のタスクからなるCybenchテストでは93%を完了した。同社によれば、セキュリティ用途にはマルウェア分析、脆弱性の優先順位付け、検知ルールの作成などが含まれる。
プログラミングテストでは、DeepSWE v1.1で61.7%、SWE-Atlas-QnAで59.4%、Terminal-Bench 4で28.3%、Coding Agent Indexで49.8%を記録した。Mistralによれば、総合指標ではDeepSeek V4 ProとQwen3.8 Maxを上回った一方、プロの開発者が実施したブラインド評価ではClaude Opus 5に次ぐ2位となった。
エージェントと欧州のインフラ
このモデルは、複数のツールやアプリケーションを使って長時間のタスクを実行することにも重点を置いている。Gmail、Google Sheets、Slack、Salesforceを通じた657のエンタープライズワークフローを対象とするAutomationBenchでは、59.9%を獲得した。また、スプレッドシート、プレゼンテーション、PDFファイルの作成を対象とするAA-Briefcaseテストでは、1,393 Eloを記録した。
このモデルは、Nvidia Grace Blackwell GPU 3,800基を使用し、Mistralが所有する欧州のデータセンターでゼロから訓練された。同社によれば、欧州連合(EU)のすべての公用語を含む160以上の言語をサポートする。また、Mistralが運用し、欧州の法規制に準拠するインフラを通じて欧州でホスティングされる。公開後は、企業が自社のクラウドやオンプレミス環境で重みを実行できるようにすることを目指している。
実際には何が変わるのか?
Mistral Large 4は、大規模なマルチモーダルモデル、エージェント機能、そして公開が予定されているオープンウェイトの選択肢を組み合わせている。これにより、企業は外部APIへの依存を減らし、データと利用ポリシーをより強く管理できる可能性がある。ただし、アーキテクチャや訓練方法、追加のテスト結果の詳細はまだ公開されておらず、示された性能指標の大半は同社自身のデータに基づいている。そのため、独立した比較には重みと詳細情報の公開を待つ必要がある。
APIの料金は、入力100万トークンあたり1.36ドル、出力100万トークンあたり4.18ドルだ。Mistralによれば、このモデルは30億ユーロのSeries D資金調達ラウンド後のロードマップにおける最初の主要モデルであり、今後開発される業界別モデルや最適化モデルの基盤にもなる。