На этой неделе Mistral AI представила исследовательскую публичную версию модели Large 4. В ней около триллиона параметров, из которых одновременно задействованы 49 миллиардов. Независимая аналитическая компания Artificial Analysis (AA) поставила модели 38 баллов в своём индексе Intelligence Index — это лучший результат среди моделей, разработанных за пределами США и Китая.
Результаты тестов
В Cyber Index от AA Large 4 набрала 50 баллов — столько же, сколько китайская GLM‑5.3‑Flash. Выше результат только у MiMo‑V2.6‑Pro (56 баллов). Лучший показатель модель продемонстрировала в тесте по кибербезопасности CyberGym‑E2E‑AA: 82 %, больше, чем у MiMo‑V2.6‑Pro (79 %) и GPT‑6 Luna (78 %), показавшей максимальный результат. Модель также лучше справляется с анализом документов и изображений: в тесте GDP.pdf она набрала 19 % — столько же, сколько MiMo‑V2.6‑Pro.
Цена и доступность
Mistral берёт $1.36 за миллион входных токенов и $4.18 за миллион выходных, а за кэшированные входные данные — $0.14. В пересчёте на одну задачу из Intelligence Index это $1.13. В первые две недели предварительная версия доступна со скидкой 50 %, поэтому стоимость задачи снижается до $0.57. Компания сообщает, что полностью открытые веса модели выпустят в конце октября 2026 года.
Почему это важно
Для разработчиков, которым нужны большие языковые модели, Mistral Large 4 — вариант с высокой ёмкостью, превосходящий по нескольким тестам другие открытые модели не из США и Китая. Однако из-за более высокой цены модель может быть менее привлекательна для проектов с ограниченным бюджетом — по крайней мере, пока цены не снизятся или конкуренты не улучшат свои предложения.