Teamet bakom ggml-org publicerade llama.cpp version b11270 den 30 september 2026. Uppdateringen ändrar en GPU-operation som används av AMD:s HIP-plattform och ersätter en långsammare instruktion för byte-subtraktion med en snabbare. Versionen innehåller också nya binärpaket för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-varianter, däribland versioner med Vulkan-stöd för GPU.
Varför det spelar roll
GPU-justeringen kan göra inferens snabbare på AMD-hårdvara, och de färdigbyggda binärerna gör det enklare för utvecklare att prova llama.cpp på fler plattformar.