تیم ggml‑org نسخه b11489 از llama.cpp را منتشر کرد. طبق یادداشتهای انتشار، این بهروزرسانی بازگشایی وزنهای Q6_K را سریعتر میکند؛ فرایندی که در آن وزنهای فشردهشدهٔ مدل دوباره به اعداد قابلاستفاده تبدیل میشوند. همچنین عامل بازکردن حلقه را دوبرابر میکند. اکنون باینریهای ازپیشساخته برای Apple Silicon، Intel macOS، iOS و چند پیکربندی Ubuntu، از جمله نسخههای مبتنی بر Vulkan و CUDA، در دسترساند.
چرا مهم است
بازگشایی سریعتر به توسعهدهندگان امکان میدهد مدلهای زبانی بزرگ را با تأخیر کمتر روی همان سختافزار اجرا کنند.