llama.cppライブラリは2026年9月30日、パディング処理でサイズがオーバーフローするテンソルを拒否するパッチをリリースした。パディングを加える前に、元のサイズとアラインメントを加算して安全性を確認し、問題のあるテンソルを早い段階で弾く。新たなテストケースでは、従来は検出をすり抜けていた2⁶⁴−16バイトのテンソルを、この修正で検出できることが示されている。この更新はmacOS、Windows、Linuxに加え、CUDA版やVulkan版を含む、サポート対象のすべてのビルドに適用される。
なぜ重要か
このオーバーフローを防ぐことで、非常に大きなモデルの実行時に起きるクラッシュや結果の破損を防げる。