# llama.cpp b11517 aggiunge un’opzione di precisione per CUDA

> La libreria open source per l’inferenza di LLaMA ha pubblicato la versione b11517 il 9 ottobre 2026, aggiungendo un flag CUDA per impostare la precisione di source-1.

Oossa · 2026-10-09 · https://oossa.com/it/llama-cpp-pre-release-b11517-adds-cuda-precision-option

Il progetto llama.cpp ha pubblicato una nuova versione preliminare, b11517, il 9 ottobre 2026. L’aggiornamento aggiunge un’opzione CUDA che consente di passare la precisione di source-1 agli helper MMQ, un componente di basso livello del codice per GPU. La modifica è firmata da un collaboratore di NVIDIA e riguarda le build CUDA 12 e 13 indicate per Linux e Windows. La versione include anche target di compilazione per molte altre piattaforme, da macOS con Apple Silicon ad Android con Snapdragon.

L’aggiornamento è disponibile sulla pagina GitHub del progetto e sul sito llama.app.

## I fatti

- Il tag di rilascio b11517 è stato pubblicato il 09 ottobre 2026
- Aggiunge un flag CUDA per la precisione di source-1 (riguarda le build CUDA 12 e 13)

## Perché conta

Gli sviluppatori possono ora controllare la precisione della GPU in llama.cpp, con possibili miglioramenti delle prestazioni o dell’uso della memoria durante l’esecuzione di modelli LLaMA.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

Ultimo aggiornamento: 2026-10-09
