# llama.cpp b11496 accélère le chargement des modèles avec SYCL

> La bibliothèque open source llama.cpp a publié la version b11496 le 8 octobre 2026. Elle ajoute un mécanisme de chargement massif des modèles basé sur SYCL et utilisant un tampon circulaire épinglé.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-version-b11496-adds-sycl-bulk-upload-support

L’équipe ggml‑org a publié llama.cpp b11496 le 8 octobre 2026. Cette mise à jour ajoute une étape SYCL qui fait transiter les chargements massifs de modèles par un tampon circulaire épinglé, accélérant ainsi le chargement sur les GPU compatibles. Des binaires pour macOS (Apple Silicon et Intel), iOS et plusieurs versions d’Ubuntu (CPU, Vulkan, CUDA 12) sont disponibles au téléchargement.

## Les faits

- Version publiée : b11496 (8 octobre 2026)
- Nouveau mécanisme de chargement massif via SYCL et un tampon circulaire épinglé

## Pourquoi c'est important

Les développeurs peuvent charger plus rapidement de grands modèles de langage sur du matériel compatible avec SYCL, ce qui réduit le temps de démarrage des applications utilisant llama.cpp.

## Sources et références

1. [ggml-org/llama.cpp b11496](https://github.com/ggml-org/llama.cpp/releases/tag/b11496) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
