ggml-org har släppt llama.cpp version b11555. Uppdateringen rättar en bugg som gjorde att AVX2-processorer inte använde instruktionsuppsättningen F16C, trots att den fanns tillgänglig. I versionen ingår också nya binärpaket för Apple Silicon och Intel på macOS, iOS samt flera Ubuntu-konfigurationer, bland annat med stöd för Vulkan och CUDA 12.8.
Varför det spelar roll
Utvecklare som kör Llama-modeller på kompatibla processorer får snabbare inferens utan att behöva installera egna korrigeringar.