La biblioteca llama.cpp publicó el 30 de septiembre de 2026 un parche que bloquea los tensores cuyo tamaño se desbordaría al añadirles relleno. El cambio comprueba el tamaño original más la alineación antes de añadir el relleno y rechaza de antemano los tensores no seguros. Una nueva prueba demuestra que la corrección detecta un tensor de 2⁶⁴−16 bytes que antes no se bloqueaba. La actualización se aplica a todas las compilaciones compatibles, desde macOS hasta Windows y Linux, incluidas las versiones para CUDA y Vulkan.
Por qué importa
Evitar este desbordamiento previene fallos o resultados corruptos al ejecutar modelos muy grandes.