OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.

llama.cpp b11270: ritocco GPU e nuovi binari

La libreria open source llama.cpp ha rilasciato la versione b11270, con un’ottimizzazione per la sottrazione su GPU e binari precompilati per macOS, iOS e Ubuntu.

BreveOossa1 min di lettura

Il team ggml-org ha pubblicato llama.cpp versione b11270 il 30 settembre 2026. L’aggiornamento modifica un’operazione GPU usata dalla piattaforma HIP di AMD, sostituendo un’istruzione di sottrazione di byte più lenta con una più rapida. La release include anche nuovi pacchetti binari per macOS (Apple Silicon e Intel), iOS e diverse build di Ubuntu, comprese quelle con supporto GPU Vulkan.

Perché conta

La modifica può velocizzare l’inferenza sui dispositivi AMD, mentre i binari pronti all’uso rendono più semplice per gli sviluppatori provare llama.cpp su un maggior numero di piattaforme.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1ggml-org/llama.cpp b11270 ↗llama.cpp30 set 2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt