OossaLa IA avanza rápido. Te lo explicamos de forma sencilla.

llama.cpp b11270 mejora la resta en GPU y añade nuevos binarios

La biblioteca de código abierto llama.cpp lanzó la versión b11270, con una optimización de la resta en GPU y binarios precompilados para macOS, iOS y Ubuntu.

BreveOossa1 min de lectura

El equipo de ggml-org publicó llama.cpp versión b11270 el 30 de septiembre de 2026. La actualización modifica una operación de GPU usada por la plataforma HIP de AMD: sustituye una instrucción de resta de bytes más lenta por otra más rápida. El lanzamiento también incluye nuevos paquetes binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu, incluidas versiones con GPU y Vulkan.

Por qué importa

La mejora en GPU puede acelerar la inferencia en hardware de AMD, y los binarios listos para usar facilitan que los desarrolladores prueben llama.cpp en más plataformas.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.

Fuentes y referencias

#FuenteMedioFechaIdea clave
1ggml-org/llama.cpp b11270 ↗llama.cpp30 sept 2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 fuentes

Última actualización: ·Markdown·llms.txt