# llama.cpp: tinyBLAS supporta BF16 e FP16 sulle CPU x86

> La libreria open source llama.cpp ora vettorializza le code BF16, FP16 e FP32 nel backend tinyBLAS, accelerando l’inferenza su CPU.

Oossa · 2026-10-04 · https://oossa.com/it/llama-cpp-adds-bf16-fp16-support-in-tinyblas-for-x86-cpus

Il team ggml-org ha rilasciato la versione b11398 di llama.cpp, che aggiunge al backend CPU tinyBLAS il supporto all’elaborazione delle code BF16, FP16 e FP32 sulle piattaforme x86. Le modifiche vettorializzano anche queste code per velocizzare i calcoli. Sono disponibili binari precompilati per macOS (Apple Silicon e Intel), iOS e diverse architetture Ubuntu. L’aggiornamento include modifiche ai test per garantire confronti accurati con le implementazioni di riferimento.

## I fatti

- La versione b11398 è stata pubblicata il 4 ottobre 2026
- Aggiunge al backend tinyBLAS il supporto alle code BF16/FP16/FP32 su x86

## Perché conta

Gli sviluppatori possono ora eseguire l’inferenza degli LLM più velocemente sulle normali CPU, senza ricorrere all’accelerazione GPU.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11398](https://github.com/ggml-org/llama.cpp/releases/tag/b11398) – llama.cpp, 2026-10-04

Ultimo aggiornamento: 2026-10-04
