# llama.cpp b11391 bringt CUDA-Anpassung und neue Binärdateien

> Der Open-Source-LLM-Runner erscheint in Version b11391 mit einer kleinen CUDA-Codeänderung und neuen Binärdateien für macOS, iOS und verschiedene Ubuntu-Plattformen.

Oossa · 2026-10-04 · https://oossa.com/de/llama-cpp-vb11391-adds-cuda-tweak-and-new-pre-built-binaries

Das ggml-org-Team hat am 4. Oktober 2026 llama.cpp in Version b11391 veröffentlicht. Das Update verschiebt eine CUDA-Variable namens blocks_per_col an die Stelle, an der sie verwendet wird. Die Änderung wurde von Adrien Gallouët freigegeben. Außerdem enthält die Veröffentlichung neue vorkompilierte Binärdateien für macOS mit Apple Silicon, macOS mit Intel-Prozessoren, iOS sowie mehrere Ubuntu-Versionen (CPU, Vulkan und CUDA 12). Alle Dateien stehen auf der GitHub-Seite der Veröffentlichung zum Download bereit.

## Die Fakten

- Version b11391 wurde am 2026-10-04 veröffentlicht
- Enthält eine CUDA-Codeänderung und Binärdateien für macOS, iOS und Ubuntu (CPU, Vulkan, CUDA 12)

## Warum es wichtig ist

Entwickler können llama.cpp jetzt ohne zusätzlichen Aufwand auf mehr Hardware ausführen – besonders, wenn sie CUDA-fähige GPUs verwenden.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11391](https://github.com/ggml-org/llama.cpp/releases/tag/b11391) – llama.cpp, 2026-10-04

Zuletzt aktualisiert: 2026-10-04
