Oossa

llama.cpp新增对WebGPU重复操作的支持

llama.cpp b11523版修复了WebGPU对DUP操作的处理问题,运行混合批次模型时不再因此崩溃。

简讯作者: Oossa 发布日期: 1 分钟阅读

开源库llama.cpp于2026年10月9日发布b11523版。此次更新修复了该库在WebGPU上执行DUP操作时发生的崩溃问题。此前,DUP由CPU执行,其他工作则在WebGPU上运行,导致缓冲区不匹配并引发崩溃。现在,DUP与CPY(复制)和CONT操作使用相同的代码路径,因此会继续在WebGPU上运行。

为什么重要

使用WebGPU的用户现在可以运行包含混合批次的llama.cpp模型,而不会因此导致程序崩溃。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。