Le projet llama.cpp a publié la version b11488 le 2026-10-08. Elle intègre le modèle de décision LiquidAI/d1-omni-600M, renomme le type de décision en lfm2-d1-omni et met à jour le serveur pour gérer l’audio via des images ainsi qu’un alias pour les fichiers. Ces changements permettent également de conserver une activation spécifique du réseau neuronal (conformer GLU sigmoid) sur CUDA. Ils sont détaillés dans les notes de version sur GitHub.
Pourquoi c'est important
Les développeurs qui utilisent llama.cpp peuvent désormais exécuter le nouveau modèle d1-omni pour des tâches de décision, sans modifier leur code.