Oossa

llama.cpp b11555 brengt CPU-fix en nieuwe binaries

De open-sourcebibliotheek voor Llama-inferentie is bijgewerkt naar b11555. De update verhelpt een probleem waardoor AVX2-processors met F16C die instructieset niet gebruikten en bevat nieuwe builds voor macOS, iOS en Linux.

Kort berichtDoor Gepubliceerd door Oossa: 1 min lezen

ggml-org heeft versie b11555 van llama.cpp uitgebracht. De update verhelpt een bug waardoor AVX2-processors de F16C-instructieset niet gebruikten, ook als die beschikbaar was. De release bevat ook nieuwe binaire pakketten voor macOS Apple Silicon, macOS Intel, iOS en verschillende Ubuntu-configuraties, waaronder versies met ondersteuning voor Vulkan en CUDA 12.8.

Waarom het ertoe doet

Ontwikkelaars die Llama-modellen draaien op compatibele processors krijgen sneller inferentie zonder handmatige patches.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.