OossaLa IA avanza rápido. Te lo explicamos de forma sencilla.

llama.cpp añade una protección contra el desbordamiento de tensores

La versión del 30 de septiembre evita un raro error de desbordamiento al rellenar tensores grandes y mejora la estabilidad en distintas plataformas.

BreveOossa1 min de lectura

La biblioteca llama.cpp publicó el 30 de septiembre de 2026 un parche que bloquea los tensores cuyo tamaño se desbordaría al añadirles relleno. El cambio comprueba el tamaño original más la alineación antes de añadir el relleno y rechaza de antemano los tensores no seguros. Una nueva prueba demuestra que la corrección detecta un tensor de 2⁶⁴−16 bytes que antes no se bloqueaba. La actualización se aplica a todas las compilaciones compatibles, desde macOS hasta Windows y Linux, incluidas las versiones para CUDA y Vulkan.

Por qué importa

Evitar este desbordamiento previene fallos o resultados corruptos al ejecutar modelos muy grandes.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.

Fuentes y referencias

#FuenteMedioFechaIdea clave
1ggml-org/llama.cpp b11275 ↗llama.cpp30 sept 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 sept 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 fuentes

Última actualización: ·Markdown·llms.txt