# llama.cpp更新修复张量大小溢出问题

> 9月30日发布的更新修复了大型张量填充时罕见的溢出漏洞，提升了各平台的稳定性。

Oossa · 2026-09-30 · https://oossa.com/zh/llama-cpp-update-adds-guard-against-tensor-size-overflow

llama.cpp库于2026年9月30日发布补丁，阻止大小在填充过程中可能发生溢出的张量。补丁会先检查原始大小与对齐值相加是否溢出，再执行填充，从而提前拒绝不安全的张量。新增测试用例显示，该修复能够拦截一个大小为2⁶⁴−16字节、此前未被检测到的张量。此次更新适用于所有受支持的构建版本，涵盖macOS、Windows和Linux，以及CUDA和Vulkan版本。

## 事实

- 修复针对nbytes + (alignment−1)超过SIZE_MAX时发生的溢出
- 测试用例使用的张量维度为[4, 2³⁰−1, 2³⁰+1, 1]

## 为什么重要

避免这种溢出，可防止运行超大型模型时发生崩溃或结果损坏。

## 来源与参考

1. [ggml-org/llama.cpp b11275](https://github.com/ggml-org/llama.cpp/releases/tag/b11275) – llama.cpp, 2026-09-30
2. [ggml-org/llama.cpp b11276](https://github.com/ggml-org/llama.cpp/releases/tag/b11276) – llama.cpp, 2026-09-30

最后更新: 2026-09-30
