O projeto llama.cpp lançou a versão b11488 em 2026-10-08. A atualização adiciona o modelo de decisão LiquidAI/d1-omni-600M, muda o nome do tipo de decisão para lfm2-d1-omni e atualiza o servidor para processar áudio por meio de imagens e um alias para arquivos. As mudanças também mantêm uma ativação específica de rede neural (conformer GLU sigmoid) na CUDA. As atualizações estão documentadas nas notas de lançamento do GitHub.
Por que importa
Desenvolvedores que usam o llama.cpp agora podem executar o novo modelo d1-omni para tarefas de decisão sem precisar fazer alterações adicionais no código.