El equipo de ggml-org publicó la versión b11277 de llama.cpp. Esta corrige un problema al restablecer búferes que provocaba fugas de memoria. La actualización también incluye binarios precompilados para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu, con opciones de GPU Vulkan y CUDA. Los usuarios pueden descargar los archivos directamente desde la página de la versión.
Por qué importa
Corregir la fuga mejora la estabilidad para quienes ejecutan LLM localmente, y los binarios listos para usar facilitan probar llama.cpp en más plataformas.