OossaA IA evolui rápido. Nós explicamos de forma simples.

llama.cpp b11270 traz ajuste para GPU e nuevos binarios

La biblioteca de código abierto llama.cpp lanzó la versión b11270 con una optimización de resta para GPU y binarios precompilados para macOS, iOS y Ubuntu.

NotaOossa1 min de leitura

El equipo de ggml-org publicó llama.cpp versión b11270 el 30 de septiembre de 2026. La actualización modifica una operación de GPU usada por la plataforma HIP de AMD: sustituye una instrucción de resta de bytes más lenta por otra más rápida. El lanzamiento también incluye nuevos paquetes binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu, incluidas versiones con GPU habilitada para Vulkan.

Por que importa

El ajuste puede acelerar la inferencia en hardware de AMD, y los binarios listos para usar facilitan que los desarrolladores prueben llama.cpp en más plataformas.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.

Fontes e referências

#FonteVeículoDataPonto principal
1ggml-org/llama.cpp b11270 ↗llama.cpp30 de set. de 2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 fontes

Última atualização: ·Markdown·llms.txt