Die Open-Source-Bibliothek llama.cpp hat am 2026-10-09 Version b11533 veröffentlicht. Sie behebt die Kompilierung von OpenCL-Kernels auf A6x-GPUs, die auf Geräten mit einem Adreno-623-Chip abstürzte. Der Patch überspringt einen problematischen Kernel und ergänzt für GEMV-Kernels einen Workaround zur Konstantenfaltung. Außerdem wurde die GPU-Erkennungsliste aktualisiert, sodass der Adreno 623 erkannt wird. Nutzer von Linux, macOS oder iOS können vorkompilierte Binärdateien von der Release-Seite herunterladen.
Warum es wichtig ist
Entwickler können llama.cpp nun auf Android-Geräten mit Adreno-623-GPUs ausführen, ohne dass es zu Compiler-Abstürzen kommt.