OossaAI ontwikkelt zich snel. Wij leggen het eenvoudig uit.

llama.cpp voorkomt overflow bij tensorafmetingen

De release van 30 september voorkomt een zeldzame overflowfout bij het opvullen van grote tensors en verbetert zo de stabiliteit op alle platforms.

Kort berichtOossa1 min lezen

De llama.cpp-bibliotheek bracht op 30 september 2026 een patch uit die tensors blokkeert waarvan de grootte tijdens het opvullen zou overlopen. De wijziging controleert de ruwe grootte plus de uitlijning voordat er opvulling wordt toegevoegd, en weigert onveilige tensors direct. Een nieuwe test laat zien dat de oplossing een tensor van 2⁶⁴−16 bytes onderschept die eerder niet werd tegengehouden. De update geldt voor alle ondersteunde builds, van macOS tot Windows en Linux, inclusief de CUDA- en Vulkan-versies.

Waarom het ertoe doet

Door deze overflow te voorkomen, worden crashes of beschadigde resultaten voorkomen bij het draaien van zeer grote modellen.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Bronnen en referenties

#BronMediumDatumKernpunt
1ggml-org/llama.cpp b11275 ↗llama.cpp30 sep 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 sep 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 bronnen

Laatst bijgewerkt: ·Markdown·llms.txt