9 октября 2026 года вышла версия b11523 библиотеки с открытым исходным кодом llama.cpp. Обновление устраняет сбой, который возникал при попытке выполнить операцию DUP на WebGPU. Раньше DUP выполнялась на CPU, тогда как остальные операции — на WebGPU. Из-за несоответствия буферов программа аварийно завершалась. Теперь DUP, как и операции CPY (копирование) и CONT, выполняется по тому же коду и остаётся на WebGPU.
Почему это важно
Пользователи WebGPU смогут запускать в llama.cpp модели со смешанными пакетами без сбоев.