30 сентября 2026 года библиотека llama.cpp получила патч, который блокирует тензоры, размер которых может переполниться при дополнении. Перед добавлением отступа система проверяет исходный размер с учётом выравнивания и заранее отклоняет небезопасные тензоры. Новый тест показывает, что исправление обнаруживает тензор размером 2⁶⁴−16 байт, который раньше проходил проверку. Обновление распространяется на все поддерживаемые сборки — macOS, Windows и Linux, включая версии для CUDA и Vulkan.
Почему это важно
Предотвращение переполнения помогает избежать сбоев и искажения результатов при запуске очень больших моделей.