# llama.cpp v0.1.15 corregge un errore CUDA e aggiunge nuovi binari

> La release di ggml-org dell’8 ottobre 2026 corregge un problema di memoria CUDA e offre binari precompilati per macOS, iOS e diverse piattaforme Linux.

Oossa · 2026-10-08 · https://oossa.com/it/llama-cpp-v0-1-15-adds-cuda-out-of-bounds-fix-and-new-binaries

La libreria open source llama.cpp ha rilasciato la versione b11511 l’8 ottobre 2026. La release corregge un bug di lettura fuori dai limiti nella memoria CUDA nell’implementazione MMQ. Aggiunge inoltre binari pronti all’uso per macOS (Apple Silicon e Intel), iOS e Ubuntu su x64, arm64 e s390x, oltre a build Vulkan e CUDA 12.8.

## I fatti

- Tag della release: b11511
- Correzione: letture CUDA MMQ fuori dai limiti (#29953) – rilasciata l’8 ottobre 2026

## Perché conta

Gli sviluppatori possono eseguire llama.cpp su più dispositivi senza arresti anomali, soprattutto se usano GPU NVIDIA.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11511](https://github.com/ggml-org/llama.cpp/releases/tag/b11511) – llama.cpp, 2026-10-08

Ultimo aggiornamento: 2026-10-08
