OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.

llama.cpp b11268 corregge OpenCL per le GPU Adreno

Il runner open source per LLM aggiorna il codice OpenCL per correggere la gestione dei tensori sulle GPU Adreno e distribuisce nuovi binari per macOS, iOS e Linux.

BreveOossa1 min di lettura

Il team ggml‑org ha pubblicato la versione b11268 di llama.cpp. L’aggiornamento corregge un bug nel driver OpenCL che gestiva i tensori per il kernel q5_K delle GPU Adreno. Sono disponibili nuovi binari precompilati per macOS con Apple Silicon, Mac Intel, iOS e diverse configurazioni Linux, incluse CPU, Vulkan e CUDA 12.8.

Perché conta

La correzione migliora prestazioni e stabilità per gli sviluppatori che eseguono LLM su dispositivi Android con GPU Adreno.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1ggml-org/llama.cpp b11268 ↗llama.cpp30 set 2026<details open> opencl: fix get_tensor for q5_K adreno gemm_nonshuffle kernel (#29555) </details> **Website:** - <https://llama.app> **Attest

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt