# llama.cpp از GLM‑5.3‑Flash پشتیبانی می‌کند و سریع‌تر می‌شود

> نسخهٔ v0.1.0 از محیط اجرای متن‌باز llama.cpp از مدل GLM‑5.3‑Flash پشتیبانی می‌کند و چند بهبود سرعت و حافظه دارد.

Oossa · 2026-09-30 · https://oossa.com/fa/llama-cpp-updates-add-glm-5-3-flash-support-and-performance-tweaks

با کمک هوش مصنوعی تهیه و ترجمه شده است. منابع اصلی زیر را بررسی کنید.

پروژهٔ llama.cpp نسخهٔ تازه‌ای را در ۳۰ سپتامبر ۲۰۲۶ منتشر کرد. این نسخه از GLM‑5.3‑Flash (که GLM5‑Next هم نامیده می‌شود)، معماری جدیدتر مدل‌های زبانی، پشتیبانی می‌کند. به‌روزرسانی همچنین اندازهٔ بافر محاسباتی را کاهش می‌دهد، رمزگشایی متن‌های طولانی را سرعت می‌بخشد و چندین باگ مربوط به مدیریت توکن‌ها و حافظهٔ GPU را رفع می‌کند. این تغییرات برای توسعه‌دهندگانی طراحی شده‌اند که مدل‌های زبانی بزرگ را به‌صورت محلی روی CPU یا GPU اجرا می‌کنند.

## حقایق

- تاریخ انتشار: ۲۰۲۶‑۰۹‑۳۰ («چهارشنبه، ۳۰ سپتامبر ۲۰۲۶»)
- افزودن پشتیبانی از مدل GLM‑5.3‑Flash (GLM5‑Next)

## چرا مهم است

قابلیت‌های تازه به کاربران امکان می‌دهد جدیدترین مدل‌های GLM را سریع‌تر و با حافظهٔ کمتر روی سخت‌افزار خود اجرا کنند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11279](https://github.com/ggml-org/llama.cpp/releases/tag/b11279) – llama.cpp, 2026-09-30
2. [add GLM-5.3-Flash (GLM5-Next) support by timkhronos · Pull Request #27773 · ggml-org/llama.cpp](https://www.reddit.com/r/LocalLLaMA/comments/1wu0bdf/add_glm53flash_glm5next_support_by_timkhronos/) – Reddit r/LocalLLaMA, 2026-09-30
3. [add GLM-5.3-Flash (GLM5-Next) support (#27773) · ggml-org/llama.cpp@649dcb1](https://www.reddit.com/r/LocalLLaMA/comments/1wu3wxu/add_glm53flash_glm5next_support_27773/) – Reddit r/LocalLLaMA, 2026-09-30

آخرین به‌روزرسانی: 2026-09-30
