OossaИИ быстро развивается. Объясняем просто.

llama.cpp b11270: оптимизация GPU и новые бинарные сборки

В библиотеке с открытым исходным кодом llama.cpp вышла версия b11270: в ней оптимизировано вычитание на GPU и добавлены готовые бинарные сборки для macOS, iOS и Ubuntu.

ЗаметкаOossa1 мин чтения

Команда ggml-org выпустила llama.cpp версии b11270 30 сентября 2026 года. В релизе изменена операция для GPU на платформе AMD HIP: более медленная инструкция вычитания байтов заменена на более быструю. Также добавлены новые бинарные пакеты для macOS (Apple Silicon и Intel), iOS и нескольких сборок Ubuntu, в том числе версий с поддержкой GPU через Vulkan.

Почему это важно

Оптимизация GPU может ускорить инференс на оборудовании AMD, а готовые бинарные сборки упрощают разработчикам знакомство с llama.cpp на большем числе платформ.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.

Источники и ссылки

#ИсточникИзданиеДатаГлавное
1ggml-org/llama.cpp b11270 ↗llama.cpp30 сент. 2026 г.<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 источников

Обновлено: ·Markdown·llms.txt