Oossa

llama.cpp ne remplace plus les requêtes en cours

La version du 10 oct. 2026 corrige un bug qui pouvait corrompre une génération en cours en réécrivant le cache de prompt.

BrèvePar Publié par Oossa: 1 min de lecture

Le projet llama.cpp a publié la version b11552 le 2026‑10‑10. Cette mise à jour empêche une requête de modifier le cache de prompt d’un emplacement déjà occupé. Auparavant, cet emplacement était écrasé, ce qui amenait la génération à se poursuivre avec un contexte erroné. Désormais, l’emplacement occupé reste inchangé et la nouvelle requête attend qu’il soit libre.

Pourquoi c'est important

Les développeurs qui utilisent llama.cpp constateront moins d’erreurs de génération lorsque plusieurs requêtes partagent la même mémoire GPU.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.