Mistral AI本周发布了Large 4模型的研究预览版。该模型约有1万亿个参数,其中任一时刻有490亿个处于激活状态。独立基准测试机构Artificial Analysis(AA)在其智能指数中为该模型打出38分,是来自美国和中国以外地区的模型中得分最高的。
测试表现
在AA的网络安全指数中,Large 4得分50,与中国的GLM-5.3-Flash持平,仅低于得分更高的MiMo-V2.6-Pro(56分)。它的最佳表现出现在CyberGym-E2E-AA网络安全任务中,得分为82%,高于MiMo-V2.6-Pro(79%)和满分为78%的GPT-6 Luna。该模型在文档和图像推理方面也有所提升,在GDP.pdf测试中达到19%,与MiMo-V2.6-Pro持平。
价格与供应情况
Mistral对每百万输入token收费$1.36,每百万输出token收费$4.18,缓存输入另收$0.14。按此计算,智能指数上的每项任务成本为$1.13。预览版前两周提供50%折扣,每项任务成本降至$0.57。该公司表示,将于2026年10月底发布完整模型权重。
为什么重要
对于需要大规模语言模型的开发者,Mistral Large 4提供了高容量选择,在多项基准测试中胜过其他来自美国和中国以外地区的开放模型。不过,它的价格较高,对成本敏感的项目吸引力可能有限,除非价格下降或竞争对手有所进步。