30 сентября 2026 года проект llama.cpp выпустил версию b11294. В обновлении появилась предварительная загрузка строк в Windows: библиотека может заранее загружать данные модели, чтобы ускорить генерацию. Изменение предложил Pranesh Gonegandla; его включили без дополнительных правок. В обновление также вошли небольшая очистка кода и исправления сборки.
Почему это важно
Благодаря новой логике предварительной загрузки инференс моделей в llama.cpp на компьютерах с Windows будет быстрее.