OossaL'IA évolue vite. Nous l'expliquons simplement.

llama.cpp b11268 corrige OpenCL pour les GPU Adreno

Le moteur LLM open source met à jour son code OpenCL pour corriger la gestion des tenseurs sur les GPU Adreno et propose de nouveaux binaires pour macOS, iOS et Linux.

BrèveOossa1 min de lecture

L’équipe ggml-org a publié la version b11268 de llama.cpp. Cette mise à jour corrige un bogue du pilote OpenCL qui affectait la gestion des tenseurs par le noyau GPU Adreno q5_K. De nouveaux binaires précompilés sont proposés pour les Mac Apple Silicon, les Mac Intel, iOS et plusieurs configurations Linux, notamment CPU, Vulkan et CUDA 12.8.

Pourquoi c'est important

Ce correctif améliore les performances et la stabilité pour les développeurs qui exécutent des LLM sur des appareils Android équipés de GPU Adreno.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.

Sources et références

#SourceMédiaDateÀ retenir
1ggml-org/llama.cpp b11268 ↗llama.cpp30 sept. 2026<details open> opencl: fix get_tensor for q5_K adreno gemm_nonshuffle kernel (#29555) </details> **Website:** - <https://llama.app> **Attest

1 sources

Dernière mise à jour: ·Markdown·llms.txt