Mistral AI این هفته پیشنمایش عمومی پژوهشی مدل Large 4 را منتشر کرد. این مدل حدود یک تریلیون پارامتر دارد که در هر لحظه ۴۹ میلیارد از آنها فعالاند. شرکت مستقل بنچمارک Artificial Analysis (AA) در شاخص هوش خود به این مدل امتیاز ۳۸ داد؛ بالاترین امتیاز در میان مدلهایی که از آمریکا یا چین نیامدهاند.
عملکرد در آزمونها
Large 4 در شاخص سایبری AA امتیاز ۵۰ گرفت؛ همامتیاز با مدل چینی GLM‑5.3‑Flash و پایینتر از MiMo‑V2.6‑Pro که امتیاز بالاتری، یعنی ۵۶، کسب کرد. بهترین نتیجه مدل در آزمون امنیت سایبری CyberGym‑E2E‑AA ثبت شد: امتیاز ۸۲٪، بالاتر از MiMo‑V2.6‑Pro با ۷۹٪ و GPT‑6 Luna با امتیاز کامل ۷۸٪. این مدل در استدلال درباره اسناد و تصاویر نیز بهتر عمل کرد و در آزمون GDP.pdf به ۱۹٪ رسید؛ نتیجهای برابر با MiMo‑V2.6‑Pro.
قیمت و دسترسی
Mistral برای هر یک میلیون توکن ورودی $1.36 و برای هر یک میلیون توکن خروجی $4.18 دریافت میکند؛ هزینه ورودی ذخیرهشده نیز $0.14 است. هزینه هر وظیفه در شاخص هوش به این ترتیب به $1.13 میرسد. پیشنمایش در دو هفته نخست با ۵۰٪ تخفیف عرضه میشود و هزینه هر وظیفه را به $0.57 کاهش میدهد. این شرکت میگوید وزنهای کامل مدل را در پایان اکتبر ۲۰۲۶ منتشر خواهد کرد.
چرا مهم است
برای توسعهدهندگانی که به مدلهای زبانی بزرگ نیاز دارند، Mistral Large 4 گزینهای پرظرفیت است که در چندین بنچمارک از دیگر مدلهای متنباز خارج از آمریکا و چین بهتر عمل میکند. بااینحال، قیمت بالاتر ممکن است آن را برای پروژههای حساس به هزینه کمجاذبهتر کند؛ دستکم تا زمانی که قیمتها کاهش یابد یا رقابت بهتر شود.