# llama.cpp b11517 ergänzt CUDA-Option für Präzision

> Die Open-Source-Inferenzbibliothek LLaMA erschien am 9. Okt. 2026 in Version b11517. Neu ist eine CUDA-Option, mit der sich die Präzision von source-1 festlegen lässt.

Oossa · 2026-10-09 · https://oossa.com/de/llama-cpp-pre-release-b11517-adds-cuda-precision-option

Das llama.cpp-Projekt hat am 9. Okt. 2026 eine neue Vorabversion mit dem Namen b11517 veröffentlicht. Das Update ergänzt eine CUDA-Option, mit der Nutzer die Präzision von source-1 an die MMQ-Hilfsfunktionen übergeben können – einen niedrigstufigen Teil des GPU-Codes. Die Änderung stammt von einem NVIDIA-Mitwirkenden und gilt für die aufgeführten CUDA-12- und CUDA-13-Builds für Linux und Windows. Die Veröffentlichung umfasst außerdem Build-Ziele für viele weitere Plattformen, von Apple-Silicon-Macs bis hin zu Android-Geräten mit Snapdragon.

Das Update ist auf der GitHub-Seite des Projekts und auf der Website llama.app verfügbar.

## Die Fakten

- Release-Tag b11517 am 9. Okt. 2026 veröffentlicht
- Ergänzt eine CUDA-Option für die Präzision von source-1 (betrifft CUDA-12- und CUDA-13-Builds)

## Warum es wichtig ist

Entwickler können nun die GPU-Präzision in llama.cpp steuern. Das könnte die Leistung oder den Speicherbedarf beim Ausführen von LLaMA-Modellen verbessern.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

Zuletzt aktualisiert: 2026-10-09
