Questa settimana Mistral AI ha reso disponibile un’anteprima pubblica a scopo di ricerca del modello Large 4. Il modello conta circa un trilione di parametri, di cui 49 miliardi sono attivi in ogni momento. Artificial Analysis (AA), società indipendente che valuta i benchmark, gli ha assegnato 38 punti nel suo Intelligence Index: il punteggio più alto tra i modelli sviluppati al di fuori degli Stati Uniti e della Cina.
I risultati dei test
Nel Cyber Index di AA, Large 4 ha ottenuto 50 punti, eguagliando il cinese GLM‑5.3‑Flash e restando dietro solo al MiMo‑V2.6‑Pro, che ha totalizzato 56 punti. Il risultato migliore è arrivato nel test di cybersecurity CyberGym‑E2E‑AA, con un punteggio dell’82 %: meglio di MiMo‑V2.6‑Pro (79 %) e di GPT‑6 Luna, che ha raggiunto il punteggio massimo (78 %). Il modello ha migliorato anche le capacità di ragionamento su documenti e immagini, ottenendo il 19 % nel test GDP.pdf, lo stesso risultato di MiMo‑V2.6‑Pro.
Prezzo e disponibilità
Mistral applica una tariffa di $1.36 per milione di token in ingresso e $4.18 per milione di token in uscita, oltre a $0.14 per l’input memorizzato nella cache. Il costo per attività dell’Intelligence Index è quindi di $1.13. Per le prime due settimane, l’anteprima è disponibile con uno sconto del 50 %, che riduce il costo per attività a $0.57. L’azienda afferma che i pesi completi del modello saranno rilasciati alla fine di ottobre 2026.
Perché conta
Per gli sviluppatori che hanno bisogno di modelli linguistici su larga scala, Mistral Large 4 offre un’opzione ad alta capacità che supera diversi benchmark rispetto agli altri modelli open non statunitensi e non cinesi. Il prezzo più elevato, tuttavia, potrebbe renderlo meno interessante per i progetti attenti ai costi, almeno finché le tariffe non scenderanno o la concorrenza non migliorerà.