Oossa

llama.cpp v0.2.0 behebt Verlangsamung auf AMD-iGPUs

Die Open-Source-Bibliothek für LLaMA-Inferenz enthält einen Vulkan-Fix für integrierte AMD-Grafik und aktualisierte vorgefertigte Pakete für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das ggml-org-Team hat am 2026-10-07 llama.cpp in Version b11461 veröffentlicht. Das Update behebt das langsame Einlesen von Checkpoints bei der Nutzung von Vulkan auf integrierten AMD-GPUs. Außerdem gibt es neue Binärpakete für Apple Silicon, Intel-Macs, iOS und mehrere Linux-Varianten (CPU, Vulkan, CUDA 12.8). Das passende Archiv können Nutzer von der GitHub-Release-Seite herunterladen.

Warum es wichtig ist

AMD-Laptop-Nutzer können LLaMA-Modelle nun schneller ausführen, ohne die bisherige Verlangsamung.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.