Die Bibliothek llama.cpp hat am 30. September 2026 einen Patch veröffentlicht, der Tensoren blockiert, deren Größe beim Auffüllen einen Überlauf verursachen würde. Die Änderung prüft die Rohgröße zuzüglich der Ausrichtung, bevor sie den Füllwert hinzufügt, und weist unsichere Tensoren frühzeitig zurück. Ein neuer Testfall zeigt, dass die Korrektur einen Tensor mit 2⁶⁴−16 Byte abfängt, der zuvor durchgerutscht war. Das Update gilt für alle unterstützten Builds – von macOS über Windows bis Linux, einschließlich der CUDA- und Vulkan-Versionen.
Warum es wichtig ist
Durch das Verhindern dieses Überlaufs lassen sich Abstürze oder verfälschte Ergebnisse vermeiden, wenn sehr große Modelle ausgeführt werden.