OossaAI utvecklas fort. Vi förklarar det enkelt.

llama.cpp stoppar översvämning av tensorstorlekar

Versionen från 30 september åtgärdar ett ovanligt översvämningsfel vid utfyllnad av stora tensorer och förbättrar stabiliteten på olika plattformar.

NotisOossa1 min läsning

llama.cpp släppte en korrigering den 30 september 2026 som stoppar tensorer vars storlek skulle översvämma vid utfyllnad. Ändringen kontrollerar den råa storleken plus justeringen innan utfyllnaden läggs till, så osäkra tensorer avvisas i ett tidigt skede. Ett nytt testfall visar att korrigeringen fångar en tensor på 2⁶⁴−16 byte som tidigare slank igenom. Uppdateringen gäller alla versioner som stöds, från macOS till Windows och Linux, inklusive CUDA- och Vulkan-versionerna.

Varför det spelar roll

Genom att stoppa den här översvämningen förhindras krascher och felaktiga resultat när mycket stora modeller körs.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1ggml-org/llama.cpp b11275 ↗llama.cpp30 sep. 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 sep. 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 källor

Senast uppdaterad: ·Markdown·llms.txt