O projeto llama.cpp lançou a versão b11294 em 30 de setembro de 2026. A atualização adiciona a leitura antecipada de linhas no Windows, permitindo que a biblioteca carregue dados do modelo antes de serem necessários e acelere a geração. A mudança foi proposta por Pranesh Gonegandla e incorporada sem alterações adicionais. A versão também inclui pequenos ajustes e correções no processo de compilação.
Por que importa
Os usuários do llama.cpp no Windows terão inferência de modelos mais rápida graças à nova lógica de leitura antecipada.