El proyecto llama.cpp publicó la versión b11488 el 2026-10-08. Incorpora el modelo de decisión LiquidAI/d1-omni-600M, cambia el nombre del tipo de decisión a lfm2-d1-omni y actualiza el servidor para gestionar audio mediante imágenes y un alias para archivos. Los cambios también mantienen en CUDA una activación específica de red neuronal (conformer GLU sigmoid). Estas actualizaciones están documentadas en las notas de la versión de GitHub.
Por qué importa
Los desarrolladores que usan llama.cpp ya pueden ejecutar el nuevo modelo d1-omni para tareas de decisión sin tener que hacer cambios adicionales en el código.