OossaAI utvecklas fort. Vi förklarar det enkelt.

llama.cpp b11270 förbättrar GPU-prestandan och lägger till binärer

Biblioteket llama.cpp med öppen källkod släppte version b11270 med en optimering för GPU-subtraktion och färdigbyggda binärer för macOS, iOS och Ubuntu.

NotisOossa1 min läsning

Teamet bakom ggml-org publicerade llama.cpp version b11270 den 30 september 2026. Uppdateringen ändrar en GPU-operation som används av AMD:s HIP-plattform och ersätter en långsammare instruktion för byte-subtraktion med en snabbare. Versionen innehåller också nya binärpaket för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-varianter, däribland versioner med Vulkan-stöd för GPU.

Varför det spelar roll

GPU-justeringen kan göra inferens snabbare på AMD-hårdvara, och de färdigbyggda binärerna gör det enklare för utvecklare att prova llama.cpp på fler plattformar.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1ggml-org/llama.cpp b11270 ↗llama.cpp30 sep. 2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 källor

Senast uppdaterad: ·Markdown·llms.txt