OossaИИ быстро развивается. Объясняем просто.

Обновление llama.cpp защищает от переполнения размера тензора

Релиз от 30 сентября устраняет редкую ошибку переполнения при дополнении больших тензоров и повышает стабильность на разных платформах.

ЗаметкаOossa1 мин чтения

30 сентября 2026 года библиотека llama.cpp получила патч, который блокирует тензоры, размер которых может переполниться при дополнении. Перед добавлением отступа система проверяет исходный размер с учётом выравнивания и заранее отклоняет небезопасные тензоры. Новый тест показывает, что исправление обнаруживает тензор размером 2⁶⁴−16 байт, который раньше проходил проверку. Обновление распространяется на все поддерживаемые сборки — macOS, Windows и Linux, включая версии для CUDA и Vulkan.

Почему это важно

Предотвращение переполнения помогает избежать сбоев и искажения результатов при запуске очень больших моделей.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.

Источники и ссылки

#ИсточникИзданиеДатаГлавное
1ggml-org/llama.cpp b11275 ↗llama.cpp30 сент. 2026 г.<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 сент. 2026 г.<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 источников

Обновлено: ·Markdown·llms.txt