Mistral AIは今週、Large 4の研究プレビュー版を公開した。モデルのパラメーター数は約1兆で、常時稼働するのはそのうち490億だ。独立系ベンチマーク企業Artificial Analysis(AA)のIntelligence Indexでは38点を獲得し、米国と中国以外で開発されたモデルとして最高点となった。
テストでの性能
AAのCyber Indexでは50点を獲得。中国のGLM-5.3-Flashと同点で、より高得点のMiMo-V2.6-Pro(56点)に次いだ。最高の成績を収めたのはサイバーセキュリティ課題のCyberGym-E2E-AAで、82%を記録。MiMo-V2.6-Pro(79%)と、最高点を記録したGPT-6 Luna(78%)を上回った。また、文書や画像の推論性能も向上し、GDP.pdfテストではMiMo-V2.6-Proと同じ19%に達した。
価格と提供時期
料金は入力トークン100万件当たり$1.36、出力トークン100万件当たり$4.18で、キャッシュ済み入力には$0.14がかかる。Intelligence Indexのタスク1件当たりに換算すると$1.13となる。プレビュー版の提供開始から最初の2週間は50%割引が適用され、タスク当たりの料金は$0.57に下がる。同社によると、モデルの全ウェイトは2026年10月末に公開する予定だ。
なぜ重要か
大規模言語モデルを必要とする開発者にとって、Mistral Large 4は高い処理能力を備えた選択肢となる。いくつかのベンチマークでは、米国・中国以外のオープンモデルを上回る。ただし価格が高いため、料金が下がるか競争が進むまでは、コストを重視するプロジェクトには魅力が薄い可能性がある。