ggml-org ha rilasciato llama.cpp versione b11537. L’aggiornamento riordina get_rows nel grafo per gli embedding e corregge la gestione degli embedding di Gemma4. Aggiunge inoltre una nota TODO per il supporto a LoRA e corregge i percorsi degli embedding grezzi. Sono ora disponibili binari precompilati per macOS Apple Silicon, macOS Intel, iOS e diverse versioni di Ubuntu, comprese quelle con supporto Vulkan.
Perché conta
Gli sviluppatori possono eseguire llama.cpp in locale su più piattaforme e contare su un supporto agli embedding corretto, con meno complicazioni nella configurazione.