OossaKI entwickelt sich schnell. Wir erklären es einfach.

llama.cpp v0.1.0: GPU-Optimierung und neue Binärdateien

Die Open-Source-Bibliothek llama.cpp ist in Version b11270 erschienen – mit einer GPU-Optimierung für Subtraktionen und vorgefertigten Binärdateien für macOS, iOS und Ubuntu.

KurzmeldungOossa1 Min. Lesezeit

Das ggml‑org-Team hat llama.cpp Version b11270 am 30. September 2026 veröffentlicht. Dabei wurde eine GPU-Operation für AMDs HIP-Plattform angepasst: Eine langsamere Byte-Subtraktionsanweisung wurde durch eine schnellere ersetzt. Die Veröffentlichung umfasst außerdem neue Binärpakete für macOS (Apple Silicon und Intel), iOS sowie mehrere Ubuntu-Versionen, darunter Varianten mit Vulkan-Unterstützung für GPUs.

Warum es wichtig ist

Die GPU-Optimierung kann die Inferenz auf AMD-Hardware beschleunigen. Die sofort einsatzbereiten Binärdateien erleichtern es Entwicklern zudem, llama.cpp auf weiteren Plattformen auszuprobieren.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1ggml-org/llama.cpp b11270 ↗llama.cpp30.09.2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 Quellen

Zuletzt aktualisiert: ·Markdown·llms.txt