El equipo de ggml-org lanzó la versión b11471 de llama.cpp. Incorpora 30090 nuevos tokens plamo fim al vocabulario del modelo. La versión también ofrece binarios listos para usar en macOS con Apple Silicon, macOS con Intel, iOS y varias configuraciones de Linux (CPU, Vulkan y CUDA 12.8). Los usuarios pueden descargar el paquete adecuado desde la página de versiones de GitHub.
Por qué importa
Los desarrolladores ya pueden ejecutar llama.cpp localmente en más dispositivos sin tener que compilarlo desde el código fuente, lo que ahorra tiempo y simplifica las pruebas.