Oossa

llama.cpp v b11527 bringt 2D-WebGPU-Dispatch und neue Builds

Die Open-Source-Laufzeitumgebung für LLMs stellt ihre WebGPU-Engine auf 2D-Dispatch um und veröffentlicht neue Builds für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat am 2026-10-09 llama.cpp Version b11527 veröffentlicht. Das Update stellt alle WebGPU-Operationen auf einen 2D-Workgroup-Dispatch um und ersetzt damit das bisherige 1D-Verfahren. Außerdem enthält es neue vorkompilierte Binärdateien für macOS (Apple Silicon und Intel), iOS und verschiedene Ubuntu-Konfigurationen, darunter Builds mit Vulkan und CUDA. Die Änderungen sollen für eine flüssigere GPU-Leistung in Browsern sorgen und die Einrichtung auf unterstützten Geräten vereinfachen.

Warum es wichtig ist

Entwickler können LLMs in WebGPU-fähigen Browsern schneller ausführen, ohne eigenen Kernel-Code schreiben zu müssen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.