Teamet bakom ggml-org har släppt llama.cpp version b11268. Uppdateringen rättar ett fel i OpenCL-drivrutinen som hanterade tensorer för Adreno-GPU-kärnan q5_K. Nya förbyggda binärfiler finns för Apple Silicon-datorer med macOS, Intel-Mac-datorer, iOS och flera Linux-konfigurationer, däribland CPU, Vulkan och CUDA 12.8.
Varför det spelar roll
Rättningen förbättrar prestanda och stabilitet för utvecklare som kör LLM:er på Android-enheter med Adreno-GPU:er.