Oossa

Mistral Large 4、米中以外のモデルで最高評価

Mistralの新モデルは約1兆パラメーターを備え、独立指標で38点を獲得。一方、タスク当たりの費用は競合するオープンモデルより高い。

著者: Oossa公開日: 1 分で読める

ThisisEngineering · Unsplash

Mistral AIは今週、Large 4の研究プレビュー版を公開した。モデルのパラメーター数は約1兆で、常時稼働するのはそのうち490億だ。独立系ベンチマーク企業Artificial Analysis(AA)のIntelligence Indexでは38点を獲得し、米国と中国以外で開発されたモデルとして最高点となった。

テストでの性能

AAのCyber Indexでは50点を獲得。中国のGLM-5.3-Flashと同点で、より高得点のMiMo-V2.6-Pro(56点)に次いだ。最高の成績を収めたのはサイバーセキュリティ課題のCyberGym-E2E-AAで、82%を記録。MiMo-V2.6-Pro(79%)と、最高点を記録したGPT-6 Luna(78%)を上回った。また、文書や画像の推論性能も向上し、GDP.pdfテストではMiMo-V2.6-Proと同じ19%に達した。

価格と提供時期

料金は入力トークン100万件当たり$1.36、出力トークン100万件当たり$4.18で、キャッシュ済み入力には$0.14がかかる。Intelligence Indexのタスク1件当たりに換算すると$1.13となる。プレビュー版の提供開始から最初の2週間は50%割引が適用され、タスク当たりの料金は$0.57に下がる。同社によると、モデルの全ウェイトは2026年10月末に公開する予定だ。

なぜ重要か

大規模言語モデルを必要とする開発者にとって、Mistral Large 4は高い処理能力を備えた選択肢となる。いくつかのベンチマークでは、米国・中国以外のオープンモデルを上回る。ただし価格が高いため、料金が下がるか競争が進むまでは、コストを重視するプロジェクトには魅力が薄い可能性がある。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。