Oossa

В llama.cpp добавили режим mmap для экономии памяти

Среда запуска LLM с открытым исходным кодом теперь позволяет напрямую отображать данные модели в память — это снижает расход ОЗУ в сборках для macOS, iOS и Linux.

ЗаметкаOossaОпубликовано Oossa: 1 мин чтения

Команда ggml‑org выпустила llama.cpp версии b11324. В обновлении появился режим memory-map, который позволяет не создавать вторую полноразмерную копию каждого тензора при загрузке модели. Изменение доступно в новых бинарных пакетах для macOS (Apple Silicon и Intel), iOS и нескольких сборок Ubuntu. В релизе также отмечен вклад Claude и инженера NVIDIA Пранеша Гонегандлы.

Почему это важно

Разработчики смогут запускать более крупные языковые модели на том же оборудовании. Это полезно энтузиастам и небольшим командам, которым не хватает памяти.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.