# llama.cpp v0.1.0: GPU-Optimierung und neue Binärdateien

> Die Open-Source-Bibliothek llama.cpp ist in Version b11270 erschienen – mit einer GPU-Optimierung für Subtraktionen und vorgefertigten Binärdateien für macOS, iOS und Ubuntu.

Oossa · 2026-09-30 · https://oossa.com/de/llama-cpp-v0-1-0-release-adds-gpu-subtraction-tweak-and-new-binaries

Das ggml‑org-Team hat llama.cpp Version b11270 am 30. September 2026 veröffentlicht. Dabei wurde eine GPU-Operation für AMDs HIP-Plattform angepasst: Eine langsamere Byte-Subtraktionsanweisung wurde durch eine schnellere ersetzt. Die Veröffentlichung umfasst außerdem neue Binärpakete für macOS (Apple Silicon und Intel), iOS sowie mehrere Ubuntu-Versionen, darunter Varianten mit Vulkan-Unterstützung für GPUs.

## Die Fakten

- Veröffentlichungsdatum: Mittwoch, 30. September 2026
- Enthält eine Änderung der HIP-GPU-Anweisung: __vsubss4 → __vsub4

## Warum es wichtig ist

Die GPU-Optimierung kann die Inferenz auf AMD-Hardware beschleunigen. Die sofort einsatzbereiten Binärdateien erleichtern es Entwicklern zudem, llama.cpp auf weiteren Plattformen auszuprobieren.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11270](https://github.com/ggml-org/llama.cpp/releases/tag/b11270) – llama.cpp, 2026-09-30

Zuletzt aktualisiert: 2026-09-30
