OossaAI ontwikkelt zich snel. Wij leggen het eenvoudig uit.

llama.cpp v0.1.0 krijgt GPU-optimalisatie en nieuwe binaries

De opensourcebibliotheek llama.cpp bracht versie b11270 uit, met een optimalisatie voor GPU-bewerkingen en kant-en-klare binaries voor macOS, iOS en Ubuntu.

Kort berichtOossa1 min lezen

Het ggml-org-team publiceerde llama.cpp-versie b11270 op 30 september 2026. De update past een GPU-bewerking voor AMD’s HIP-platform aan en vervangt een tragere instructie voor byte-aftrekking door een snellere. Ook bevat de release nieuwe binaire pakketten voor macOS (Apple Silicon en Intel), iOS en verschillende Ubuntu-versies, waaronder GPU-versies met Vulkan-ondersteuning.

Waarom het ertoe doet

De GPU-aanpassing kan inferentie op AMD-hardware versnellen. De kant-en-klare binaries maken het voor ontwikkelaars bovendien eenvoudiger om llama.cpp op meer platforms uit te proberen.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Bronnen en referenties

#BronMediumDatumKernpunt
1ggml-org/llama.cpp b11270 ↗llama.cpp30 sep 2026<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 bronnen

Laatst bijgewerkt: ·Markdown·llms.txt