Die Open-Source-Bibliothek llama.cpp ist am Oct 8, 2026 in Version b11511 erschienen. Sie behebt einen Fehler in der MMQ-Implementierung, der bei CUDA zu Lesezugriffen außerhalb des zulässigen Speicherbereichs führte. Das Update bietet außerdem sofort einsatzbereite Binärdateien für macOS (Apple Silicon und Intel), iOS und Ubuntu auf x64, arm64 und s390x sowie Builds für Vulkan und CUDA 12.8.
Warum es wichtig ist
Entwickler können llama.cpp jetzt auf mehr Hardware ohne Abstürze ausführen – besonders, wenn sie NVIDIA-GPUs verwenden.