OossaL'IA évolue vite. Nous l'expliquons simplement.

llama.cpp se protège contre le dépassement de taille des tenseurs

La version du 30 septembre corrige un rare bug de dépassement lors du remplissage des grands tenseurs et améliore la stabilité sur toutes les plateformes.

BrèveOossa1 min de lecture

La bibliothèque llama.cpp a publié un correctif le 30 septembre 2026 qui bloque les tenseurs dont la taille dépasserait la limite lors de leur remplissage. La modification vérifie la taille brute et l’alignement avant d’ajouter le remplissage, et rejette ainsi les tenseurs non sûrs en amont. Un nouveau test montre que le correctif détecte un tenseur de 2⁶⁴−16 octets qui passait auparavant entre les mailles du filet. La mise à jour concerne toutes les versions prises en charge, de macOS à Windows et Linux, y compris celles pour CUDA et Vulkan.

Pourquoi c'est important

Éviter ce dépassement prévient les plantages et les résultats corrompus lors de l’exécution de très grands modèles.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.

Sources et références

#SourceMédiaDateÀ retenir
1ggml-org/llama.cpp b11275 ↗llama.cpp30 sept. 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 sept. 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 sources

Dernière mise à jour: ·Markdown·llms.txt