ggml-org lanzó la versión b11537 de llama.cpp. La actualización reordena get_rows en el grafo para los embeddings y corrige el manejo de embeddings de Gemma4. También añade una nota TODO sobre la compatibilidad con LoRA y corrige las rutas de embeddings sin procesar. Ya hay binarios precompilados para macOS con Apple Silicon, macOS con Intel, iOS y varias versiones de Ubuntu, incluidas las que tienen Vulkan habilitado.
Por qué importa
Los desarrolladores ahora pueden ejecutar llama.cpp localmente en más plataformas y con la compatibilidad con embeddings corregida, lo que simplifica la configuración.