# llama.cpp adiciona suporte a produto escalar AVX512-FP16 na b11262

> A biblioteca de código aberto llama.cpp agora usa AVX512-FP16 para calcular produtos escalares de meia precisão com acumulação em precisão simples, melhorando o desempenho em CPUs.

Oossa · 2026-09-29 · https://oossa.com/pt/llama-cpp-adds-avx512-fp16-dot-product-support-in-b11262-release

A equipe ggml-org lançou a versão b11262 do llama.cpp em 29 de setembro de 2026. A atualização adiciona suporte a AVX512-FP16, que calcula produtos escalares em meia precisão (f16), mas acumula os resultados em precisão simples (f32) para maior exatidão. É uma mudança de baixo nível que acelera a inferência em CPUs compatíveis com o conjunto de instruções AVX512-FP16. A versão também inclui novos binários para macOS, iOS e várias distribuições do Linux.

## Os fatos

- A versão b11262 foi lançada em 29 de setembro de 2026
- Adiciona acumulação em f32 para produtos escalares AVX512-FP16

## Por que importa

Permite que desenvolvedores executem LLMs mais rapidamente em CPUs modernas sem perder qualidade numérica.

## Fontes e referências

1. [ggml-org/llama.cpp b11262](https://github.com/ggml-org/llama.cpp/releases/tag/b11262) – llama.cpp, 2026-09-29

Última atualização: 2026-09-29
