# llama.cpp b11466: Flash-Attention-Fix und neue Binärdateien

> Das ggml-org-Projekt hat am 7. Okt. 2026 Version b11466 veröffentlicht. Sie behebt einen Fehler in flash_attn und bietet vorgefertigte Binärdateien für macOS, iOS und verschiedene Linux-Konfigurationen.

Oossa · 2026-10-07 · https://oossa.com/de/llama-cpp-version-b11466-released-with-flash-attn-fix-and-new-binaries

ggml-org hat am 7. Okt. 2026 Version b11466 von llama.cpp veröffentlicht. Das Update behebt die Prüfung von „supports_op“ in flash_attn bei überlappenden Key-Value-Paaren. Außerdem gibt es sofort nutzbare Binärdateien für macOS mit Apple Silicon und Intel-Prozessoren, iOS sowie verschiedene Ubuntu-Versionen (CPU, Vulkan und CUDA 12.8). Die Dateien stehen auf der GitHub-Release-Seite zum Download bereit.

## Die Fakten

- Version b11466 wurde am 7. Okt. 2026 veröffentlicht.
- Die Binärdateien gibt es jetzt für macOS (Apple Silicon und Intel), iOS sowie Ubuntu (CPU, Vulkan und CUDA 12.8).

## Warum es wichtig ist

Entwickler können die aktuelle llama.cpp-Version auf mehr Plattformen nutzen, ohne den Quellcode selbst kompilieren zu müssen.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11466](https://github.com/ggml-org/llama.cpp/releases/tag/b11466) – llama.cpp, 2026-10-07

Zuletzt aktualisiert: 2026-10-07
