OossaKI entwickelt sich schnell. Wir erklären es einfach.

llama.cpp-Update schützt vor Tensorgrößen-Überlauf

Das Release vom 30. September verhindert einen seltenen Überlauffehler beim Auffüllen großer Tensoren und verbessert die Stabilität auf verschiedenen Plattformen.

KurzmeldungOossa1 Min. Lesezeit

Die Bibliothek llama.cpp hat am 30. September 2026 einen Patch veröffentlicht, der Tensoren blockiert, deren Größe beim Auffüllen einen Überlauf verursachen würde. Die Änderung prüft die Rohgröße zuzüglich der Ausrichtung, bevor sie den Füllwert hinzufügt, und weist unsichere Tensoren frühzeitig zurück. Ein neuer Testfall zeigt, dass die Korrektur einen Tensor mit 2⁶⁴−16 Byte abfängt, der zuvor durchgerutscht war. Das Update gilt für alle unterstützten Builds – von macOS über Windows bis Linux, einschließlich der CUDA- und Vulkan-Versionen.

Warum es wichtig ist

Durch das Verhindern dieses Überlaufs lassen sich Abstürze oder verfälschte Ergebnisse vermeiden, wenn sehr große Modelle ausgeführt werden.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1ggml-org/llama.cpp b11275 ↗llama.cpp30.09.2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30.09.2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 Quellen

Zuletzt aktualisiert: ·Markdown·llms.txt