# llama.cpp v b11531 traz novos binários e reformula a API

> O runtime de LLMs de código aberto lança versões para macOS, iOS e Linux, além de reformular a API de chat.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-v-b11531-adds-new-binaries-and-api-refactor

A equipe ggml-org publicou a versão b11531 do llama.cpp. A atualização reformula a API de chat e inclui binários pré-compilados para macOS (Apple Silicon e Intel), iOS e várias versões do Ubuntu, com suporte a CPU, Vulkan e CUDA 12.8. Os links para download estão na página do lançamento no GitHub. Agora, usuários podem executar LLMs localmente em mais plataformas sem precisar compilar o software.

## Os fatos

- Versão b11531 publicada em 2026-10-09
- Binários disponíveis para macOS arm64, macOS x64, iOS XCFramework e Ubuntu x64/arm64/s390x (CPU, Vulkan, CUDA 12.8)

## Por que importa

Desenvolvedores podem executar modelos Llama localmente em mais dispositivos sem precisar compilar o software, com suporte à aceleração por GPU no Ubuntu.

## Fontes e referências

1. [ggml-org/llama.cpp b11531](https://github.com/ggml-org/llama.cpp/releases/tag/b11531) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
