开源库llama.cpp于2026年10月9日发布b11523版。此次更新修复了该库在WebGPU上执行DUP操作时发生的崩溃问题。此前,DUP由CPU执行,其他工作则在WebGPU上运行,导致缓冲区不匹配并引发崩溃。现在,DUP与CPY(复制)和CONT操作使用相同的代码路径,因此会继续在WebGPU上运行。
为什么重要
使用WebGPU的用户现在可以运行包含混合批次的llama.cpp模型,而不会因此导致程序崩溃。
llama.cpp b11523版修复了WebGPU对DUP操作的处理问题,运行混合批次模型时不再因此崩溃。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
开源库llama.cpp于2026年10月9日发布b11523版。此次更新修复了该库在WebGPU上执行DUP操作时发生的崩溃问题。此前,DUP由CPU执行,其他工作则在WebGPU上运行,导致缓冲区不匹配并引发崩溃。现在,DUP与CPY(复制)和CONT操作使用相同的代码路径,因此会继续在WebGPU上运行。
使用WebGPU的用户现在可以运行包含混合批次的llama.cpp模型,而不会因此导致程序崩溃。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。