ggml‑org ha pubblicato la versione b11539 di llama.cpp, il runtime leggero per LLM che funziona su molti dispositivi. Sono disponibili nuovi archivi binari per macOS con Apple Silicon, macOS con processori Intel, iOS XCFramework e diverse versioni di Ubuntu per CPU, Vulkan e CUDA 12.8. I link per il download sono sulla pagina della release su GitHub.
Perché conta
Gli sviluppatori possono ora eseguire llama.cpp localmente su più hardware senza doverlo compilare.