تیم ggml‑org در ۳۰ سپتامبر ۲۰۲۶ نسخه b11270 از llama.cpp را منتشر کرد. در این نسخه، یکی از عملیاتهای GPU در پلتفرم HIP شرکت AMD بهینه شده و دستور تفریق بایتیِ کندتر با دستوری سریعتر جایگزین شده است. این انتشار همچنین بستههای باینری تازهای برای macOS (Apple Silicon و Intel)، iOS و چند نسخه Ubuntu، از جمله نسخههای GPU مجهز به Vulkan، ارائه میکند.
چرا مهم است
این بهینهسازی GPU میتواند اجرای مدلها را روی سختافزار AMD سریعتر کند و باینریهای آماده هم کار توسعهدهندگان را برای آزمایش llama.cpp روی پلتفرمهای بیشتری آسانتر میکنند.