OossaAIは急速に進化しています。私たちがわかりやすく解説します。

llama.cpp更新、テンソルサイズのオーバーフローを防止

9月30日のリリースで、大きなテンソルのパディング時にまれに発生するオーバーフローのバグを修正。各プラットフォームでの安定性が向上する。

短信Oossa1 分で読める

llama.cppライブラリは2026年9月30日、パディング処理でサイズがオーバーフローするテンソルを拒否するパッチをリリースした。パディングを加える前に、元のサイズとアラインメントを加算して安全性を確認し、問題のあるテンソルを早い段階で弾く。新たなテストケースでは、従来は検出をすり抜けていた2⁶⁴−16バイトのテンソルを、この修正で検出できることが示されている。この更新はmacOS、Windows、Linuxに加え、CUDA版やVulkan版を含む、サポート対象のすべてのビルドに適用される。

なぜ重要か

このオーバーフローを防ぐことで、非常に大きなモデルの実行時に起きるクラッシュや結果の破損を防げる。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。

出典と参考資料

#出典媒体日付要点
1ggml-org/llama.cpp b11275 ↗llama.cpp2026/09/30<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp2026/09/30<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 件の出典

最終更新: ·Markdown·llms.txt