# llama.cpp新增对WebGPU重复操作的支持

> llama.cpp b11523版修复了WebGPU对DUP操作的处理问题，运行混合批次模型时不再因此崩溃。

Oossa · 2026-10-09 · https://oossa.com/zh/llama-cpp-adds-webgpu-support-for-duplicate-operation

开源库llama.cpp于2026年10月9日发布b11523版。此次更新修复了该库在WebGPU上执行DUP操作时发生的崩溃问题。此前，DUP由CPU执行，其他工作则在WebGPU上运行，导致缓冲区不匹配并引发崩溃。现在，DUP与CPY（复制）和CONT操作使用相同的代码路径，因此会继续在WebGPU上运行。

## 事实

- b11523版于2026-10-09发布
- 此次修复为GGML_OP_DUP操作增加了WebGPU支持

## 为什么重要

使用WebGPU的用户现在可以运行包含混合批次的llama.cpp模型，而不会因此导致程序崩溃。

## 来源与参考

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

最后更新: 2026-10-09
