Oossa

llama.cpp-Update spart RAM durch Memory-Mapping

Die Open-Source-Laufzeitumgebung für LLMs kann Modelldaten jetzt direkt einblenden. Das spart RAM in Versionen für macOS, iOS und Linux.

KurzmeldungOossaVon Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat llama.cpp in Version b11324 veröffentlicht. Das Update bietet einen Memory-Mapping-Modus, der beim Laden von Modellen eine zweite vollständige Kopie jedes Tensors überflüssig macht. Die Neuerung ist in neuen Binärpaketen für macOS (Apple Silicon und Intel), iOS und mehrere Ubuntu-Versionen verfügbar. In den Release-Hinweisen werden außerdem Beiträge von Claude und dem NVIDIA-Ingenieur Pranesh Gonegandla erwähnt.

Warum es wichtig ist

Entwickler können auf derselben Hardware größere Sprachmodelle ausführen. Das ist hilfreich für Hobbyentwickler und kleine Teams mit begrenztem Arbeitsspeicher.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.