Mistral AI presentó esta semana una versión preliminar pública de investigación de su modelo Large 4. Tiene alrededor de un billón de parámetros, de los cuales 49 mil millones están activos en cada momento. Artificial Analysis (AA), una firma independiente de evaluación comparativa, le otorgó 38 puntos en su Intelligence Index, la puntuación más alta para un modelo desarrollado fuera de Estados Unidos o China.
Resultados en las pruebas
En el Cyber Index de AA, Large 4 obtuvo 50 puntos, igual que el modelo chino GLM‑5.3‑Flash y por debajo únicamente de MiMo‑V2.6‑Pro, que logró una puntuación más alta (56). Su mejor resultado fue en la prueba de ciberseguridad CyberGym‑E2E‑AA: obtuvo un 82 %, por encima de MiMo‑V2.6‑Pro (79 %) y de GPT‑6 Luna, que alcanzó la puntuación máxima (78 %). El modelo también mejoró en razonamiento sobre documentos e imágenes y llegó al 19 % en la prueba GDP.pdf, el mismo resultado que MiMo‑V2.6‑Pro.
Precio y disponibilidad
Mistral cobra $1.36 por cada millón de tokens de entrada y $4.18 por cada millón de tokens de salida, además de una tarifa de $0.14 por la entrada almacenada en caché. Esto equivale a $1.13 por tarea del Intelligence Index. Durante las dos primeras semanas, la versión preliminar tendrá un descuento del 50 %, que reduce el costo por tarea a $0.57. La empresa afirma que publicará los pesos completos del modelo a finales de octubre de 2026.
Por qué importa
Para los desarrolladores que necesitan modelos de lenguaje de gran escala, Mistral Large 4 ofrece una opción de gran capacidad que supera en varias pruebas comparativas a otros modelos abiertos desarrollados fuera de EE. UU. y China. Sin embargo, su precio más elevado podría restarle atractivo para proyectos con presupuestos ajustados, al menos hasta que bajen los precios o mejore la competencia.