# llama.cpp b11262版新增 AVX512-FP16 点积支持

> 开源库 llama.cpp 现可使用 AVX512-FP16，以全精度计算半精度点积，提升 CPU 性能。

Oossa · 2026-09-29 · https://oossa.com/zh/llama-cpp-adds-avx512-fp16-dot-product-support-in-b11262-release

ggml-org 团队于 2026 年 9 月 29 日发布 llama.cpp b11262 版。此次更新新增 AVX512-FP16 支持，可计算半精度（f16）点积，并以单精度（f32）累加结果，从而提高精度。这项底层改动可加快支持 AVX512-FP16 指令集的 CPU 上的推理速度。该版本还附带适用于 macOS、iOS 和多个 Linux 构建版本的新二进制文件。

## 事实

- b11262 版于 2026 年 9 月 29 日发布
- 新增 AVX512-FP16 点积，并以 f32 精度累加

## 为什么重要

开发者可以在现代 CPU 上更快地运行大语言模型，同时不损失数值精度。

## 来源与参考

1. [ggml-org/llama.cpp b11262](https://github.com/ggml-org/llama.cpp/releases/tag/b11262) – llama.cpp, 2026-09-29

最后更新: 2026-09-29
