Il progetto llama.cpp ha rilasciato la versione b11488 il 2026-10-08. La nuova versione aggiunge il modello decisionale LiquidAI/d1-omni-600M, rinomina il tipo di decisione in lfm2-d1-omni e aggiorna il server per gestire l’audio tramite immagini e un alias per i file. Le modifiche consentono inoltre di mantenere su CUDA una specifica funzione di attivazione della rete neurale (conformer GLU sigmoid). Gli aggiornamenti sono descritti nelle note di rilascio su GitHub.
Perché conta
Gli sviluppatori che usano llama.cpp possono ora eseguire il nuovo modello d1-omni per attività decisionali senza modifiche aggiuntive al codice.