ggml‑org ha rilasciato llama.cpp versione b11555. L’aggiornamento corregge un bug per cui le CPU AVX2 non utilizzavano il set di istruzioni F16C, anche quando era disponibile. La release include inoltre nuovi pacchetti binari per macOS Apple Silicon, macOS Intel, iOS e diverse configurazioni Ubuntu, comprese quelle con supporto a Vulkan e CUDA 12.8.
Perché conta
Gli sviluppatori che eseguono modelli Llama su CPU compatibili potranno ottenere un’inferenza più veloce senza applicare patch manualmente.