# llama.cpp adiciona suporte a BF16 e FP16 no tinyBLAS para CPUs x86

> A biblioteca de código aberto llama.cpp agora vetoriz­a o processamento dos dados restantes em BF16, FP16 e FP32 no backend tinyBLAS, acelerando a inferência em CPUs.

Oossa · 2026-10-04 · https://oossa.com/pt/llama-cpp-adds-bf16-fp16-support-in-tinyblas-for-x86-cpus

A equipe ggml-org lançou a versão b11398 do llama.cpp. A atualização adiciona suporte ao processamento de dados restantes em BF16, FP16 e FP32 no backend tinyBLAS para CPUs em plataformas x86. As alterações também vetorizam esse processamento para acelerar os cálculos. Há binários pré-compilados para macOS (Apple Silicon e Intel), iOS e várias arquiteturas do Ubuntu. A atualização também inclui ajustes nos testes para garantir comparações precisas com implementações de referência.

## Os fatos

- A versão b11398 foi lançada em 4 de outubro de 2026
- Adiciona suporte ao processamento de dados restantes em BF16/FP16/FP32 no tinyBLAS para x86

## Por que importa

Desenvolvedores podem executar inferência de LLMs mais rapidamente em CPUs comuns, sem aceleração por GPU.

## Fontes e referências

1. [ggml-org/llama.cpp b11398](https://github.com/ggml-org/llama.cpp/releases/tag/b11398) – llama.cpp, 2026-10-04

Última atualização: 2026-10-04
