Oossa

llama.cpp 0.1.14 prend en charge Q4_K et Q6_K tuilés sur Hexagon

La bibliothèque open source llama.cpp prend désormais en charge les formats Q4_K et Q6_K tuilés sur les processeurs Hexagon, avec de nouveaux binaires pour macOS, iOS et Linux.

BrèvePar Publié par Oossa: 1 min de lecture

L’équipe ggml‑org a publié la version b11487 de llama.cpp. Elle ajoute la prise en charge de GET_ROWS pour les formats Q4_K et Q6_K tuilés sur les processeurs Hexagon et améliore la gestion des vues Q4_K. Des binaires précompilés sont proposés pour Apple Silicon, les Mac Intel, iOS et plusieurs versions d’Ubuntu (CPU et Vulkan). La mise à jour est disponible sur la page des versions de GitHub.

Pourquoi c'est important

Les développeurs peuvent désormais exécuter des modèles Llama plus efficaces sur des appareils équipés de puces Hexagon, comme celles de Qualcomm, et améliorer ainsi les performances sur le matériel mobile et embarqué compatible.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.