# llama.cpp b11489 加快 Q6_K 权重反量化

> b11489 版本提升 Q6_K 权重反量化速度，并增加循环展开；现已提供适用于 macOS、iOS 和 Linux 的预编译二进制文件。

Oossa · 2026-10-08 · https://oossa.com/zh/llama-cpp-release-adds-q6-k-weight-dequant-speedup

ggml‑org 团队发布了 llama.cpp b11489 版本。根据发行说明，此次更新加快了 Q6_K 权重反量化——即将压缩的模型权重还原为可用数值的步骤——并将循环展开因子加倍。现在还提供了适用于 Apple Silicon、Intel macOS、iOS，以及多种 Ubuntu 配置的预编译二进制文件，其中包括 Vulkan 和 CUDA 版本。

## 事实

- 发行标签：b11489
- 发布时间：Thu Oct 08 2026

## 为什么重要

反量化速度提升后，开发者可在相同硬件上以更低延迟运行大语言模型。

## 来源与参考

1. [ggml-org/llama.cpp b11489](https://github.com/ggml-org/llama.cpp/releases/tag/b11489) – llama.cpp, 2026-10-08

最后更新: 2026-10-08
