Mistral AI a lancé cette semaine une préversion publique de recherche de son modèle Large 4. Celui-ci compte environ un billion de paramètres, dont 49 milliards sont actifs à tout moment. Artificial Analysis (AA), un organisme indépendant d’évaluation comparative, lui a attribué un score de 38 à son Intelligence Index, le meilleur résultat pour un modèle développé hors des États-Unis et de la Chine.
Résultats aux tests
Au Cyber Index d’AA, Large 4 a obtenu 50 points, à égalité avec le modèle chinois GLM‑5.3‑Flash et derrière MiMo‑V2.6‑Pro, qui a décroché le meilleur score (56). Son meilleur résultat a été obtenu au test de cybersécurité CyberGym‑E2E‑AA, avec 82 %, devant MiMo‑V2.6‑Pro (79 %) et GPT‑6 Luna, qui détient le score maximal (78 %). Le modèle a aussi progressé en compréhension de documents et d’images, atteignant 19 % au test GDP.pdf, soit le même résultat que MiMo‑V2.6‑Pro.
Prix et disponibilité
Mistral facture 1,36 $ par million de jetons en entrée et 4,18 $ par million de jetons en sortie, auxquels s’ajoutent 0,14 $ pour les jetons d’entrée mis en cache. Le coût revient ainsi à 1,13 $ par tâche de l’Intelligence Index. Pendant les deux premières semaines, la préversion bénéficie d’une réduction de 50 %, ce qui ramène le coût par tâche à 0,57 $. L’entreprise indique que les poids complets du modèle seront publiés fin octobre 2026.
Pourquoi c'est important
Pour les développeurs qui ont besoin de modèles de langage à grande échelle, Mistral Large 4 offre une option de grande capacité qui surpasse plusieurs autres modèles ouverts développés hors des États-Unis et de la Chine à différents tests. Son prix plus élevé pourrait toutefois le rendre moins intéressant pour les projets sensibles aux coûts, tant que les tarifs ne baissent pas ou que la concurrence ne progresse pas.