OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.

llama.cpp aggiunge il supporto AVX512‑FP16 in b11262

La libreria open source llama.cpp ora usa AVX512‑FP16 per calcolare prodotti scalari a precisione dimezzata con accumulo a precisione singola, migliorando le prestazioni sulle CPU.

BreveOossa1 min di lettura

Il team ggml‑org ha pubblicato llama.cpp versione b11262 il 29 settembre 2026. L’aggiornamento aggiunge il supporto AVX512‑FP16, che consente di calcolare prodotti scalari a precisione dimezzata (f16) accumulando i risultati a precisione singola (f32), per una maggiore accuratezza. Si tratta di una modifica di basso livello che velocizza l’inferenza sulle CPU dotate del set di istruzioni AVX512‑FP16. La release include anche nuovi binari per macOS, iOS e diverse distribuzioni Linux.

Perché conta

Permette agli sviluppatori di eseguire gli LLM più velocemente sulle CPU moderne senza compromettere la qualità numerica.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1ggml-org/llama.cpp b11262 ↗llama.cpp29 set 2026<details open> ggml : accumulate f16 dot products in f32 on AVX512-FP16 (#29545) Supersedes #29530 Signed-off-by: Adrien Gallouët <angt@hugg

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt