# llama.cpp suma compatibilidad con GLM‑5.3‑Flash y mejoras de rendimiento

> La versión v0.1.0 del entorno de ejecución de LLM de código abierto llama.cpp incorpora compatibilidad con el modelo GLM‑5.3‑Flash y varias mejoras de velocidad y memoria.

Oossa · 2026-09-30 · https://oossa.com/es/llama-cpp-updates-add-glm-5-3-flash-support-and-performance-tweaks

Creado y traducido con ayuda de IA. Consulta las fuentes originales abajo.

El proyecto llama.cpp publicó una nueva versión el 30 de septiembre de 2026. Esta incorpora compatibilidad con GLM‑5.3‑Flash (también llamado GLM5‑Next), una arquitectura de modelo de lenguaje más reciente. La actualización también reduce el tamaño del búfer de cálculo, acelera la decodificación con contextos largos y corrige varios errores relacionados con la gestión de tokens y la memoria de la GPU. Los cambios están pensados para desarrolladores que ejecutan LLM de forma local en CPU o GPU.

## Los hechos

- Fecha de lanzamiento: 2026‑09‑30 («mié., 30 sep. 2026»)
- Incorpora compatibilidad con el modelo GLM‑5.3‑Flash (GLM5‑Next)

## Por qué importa

Las nuevas funciones permiten ejecutar los modelos GLM más recientes con mayor rapidez y menos memoria en el hardware propio.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11279](https://github.com/ggml-org/llama.cpp/releases/tag/b11279) – llama.cpp, 2026-09-30
2. [add GLM-5.3-Flash (GLM5-Next) support by timkhronos · Pull Request #27773 · ggml-org/llama.cpp](https://www.reddit.com/r/LocalLLaMA/comments/1wu0bdf/add_glm53flash_glm5next_support_by_timkhronos/) – Reddit r/LocalLLaMA, 2026-09-30
3. [add GLM-5.3-Flash (GLM5-Next) support (#27773) · ggml-org/llama.cpp@649dcb1](https://www.reddit.com/r/LocalLLaMA/comments/1wu3wxu/add_glm53flash_glm5next_support_27773/) – Reddit r/LocalLLaMA, 2026-09-30

Última actualización: 2026-09-30
