Das ggml-org-Team hat am 2026-10-07 llama.cpp in Version b11461 veröffentlicht. Das Update behebt das langsame Einlesen von Checkpoints bei der Nutzung von Vulkan auf integrierten AMD-GPUs. Außerdem gibt es neue Binärpakete für Apple Silicon, Intel-Macs, iOS und mehrere Linux-Varianten (CPU, Vulkan, CUDA 12.8). Das passende Archiv können Nutzer von der GitHub-Release-Seite herunterladen.
Warum es wichtig ist
AMD-Laptop-Nutzer können LLaMA-Modelle nun schneller ausführen, ohne die bisherige Verlangsamung.