# llama.cpp v0.2.0 预发布版加入 Hexagon CPU 优化

> 这款开源大语言模型运行器更新了 Hexagon 后端，可加快骁龙芯片上的拼接操作。

Oossa · 2026-09-30 · https://oossa.com/zh/llama-cpp-v0-2-0-pre-release-adds-hexagon-cpu-optimizations

ggml‑org/llama.cpp 项目于 2026 年 9 月 30 日发布预发布版本（标签 b11272）。该版本针对拼接操作加入了 Hexagon 专属优化。拼接是语言模型推理中的常见步骤。此次改动减少了数据包开销，并采用更快的除法例程，加快了负责搬运数据的热点循环。此次更新是面向多个平台的一系列构建版本之一，涵盖搭载 Hexagon NPU 的 Android 骁龙设备。

## 事实

- 发布标签：b11272（提交 7fee178），于 2026 年 9 月 30 日发布
- Hexagon 拼接优化减少数据包数量，并采用快速 div 指令

## 为什么重要

这能显著提升在骁龙手机上运行大语言模型的速度，降低设备端 AI 任务的延迟。

## 来源与参考

1. [ggml-org/llama.cpp b11272](https://github.com/ggml-org/llama.cpp/releases/tag/b11272) – llama.cpp, 2026-09-30

最后更新: 2026-09-30
