Oossa

پیش‌نمایش Mistral Large 4؛ صدرنشین مدل‌های خارج از آمریکا و چین

مدل جدید یک‌تریلیون‌پارامتری Mistral در یک شاخص مستقل امتیاز ۳۸ گرفت، اما هزینه هر وظیفه با آن از مدل‌های متن‌باز رقیب بیشتر است.

نویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

ThisisEngineering · Unsplash

Mistral AI این هفته پیش‌نمایش عمومی پژوهشی مدل Large 4 را منتشر کرد. این مدل حدود یک تریلیون پارامتر دارد که در هر لحظه ۴۹ میلیارد از آن‌ها فعال‌اند. شرکت مستقل بنچمارک Artificial Analysis (AA) در شاخص هوش خود به این مدل امتیاز ۳۸ داد؛ بالاترین امتیاز در میان مدل‌هایی که از آمریکا یا چین نیامده‌اند.

عملکرد در آزمون‌ها

Large 4 در شاخص سایبری AA امتیاز ۵۰ گرفت؛ هم‌امتیاز با مدل چینی GLM‑5.3‑Flash و پایین‌تر از MiMo‑V2.6‑Pro که امتیاز بالاتری، یعنی ۵۶، کسب کرد. بهترین نتیجه مدل در آزمون امنیت سایبری CyberGym‑E2E‑AA ثبت شد: امتیاز ۸۲٪، بالاتر از MiMo‑V2.6‑Pro با ۷۹٪ و GPT‑6 Luna با امتیاز کامل ۷۸٪. این مدل در استدلال درباره اسناد و تصاویر نیز بهتر عمل کرد و در آزمون GDP.pdf به ۱۹٪ رسید؛ نتیجه‌ای برابر با MiMo‑V2.6‑Pro.

قیمت و دسترسی

Mistral برای هر یک میلیون توکن ورودی $1.36 و برای هر یک میلیون توکن خروجی $4.18 دریافت می‌کند؛ هزینه ورودی ذخیره‌شده نیز $0.14 است. هزینه هر وظیفه در شاخص هوش به این ترتیب به $1.13 می‌رسد. پیش‌نمایش در دو هفته نخست با ۵۰٪ تخفیف عرضه می‌شود و هزینه هر وظیفه را به $0.57 کاهش می‌دهد. این شرکت می‌گوید وزن‌های کامل مدل را در پایان اکتبر ۲۰۲۶ منتشر خواهد کرد.

چرا مهم است

برای توسعه‌دهندگانی که به مدل‌های زبانی بزرگ نیاز دارند، Mistral Large 4 گزینه‌ای پرظرفیت است که در چندین بنچمارک از دیگر مدل‌های متن‌باز خارج از آمریکا و چین بهتر عمل می‌کند. بااین‌حال، قیمت بالاتر ممکن است آن را برای پروژه‌های حساس به هزینه کم‌جاذبه‌تر کند؛ دست‌کم تا زمانی که قیمت‌ها کاهش یابد یا رقابت بهتر شود.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.