Oossa

llama.cpp amplia suporte a buffers Hexagon e eleva alocação padrão

A biblioteca de código aberto llama.cpp agora permite que dispositivos Hexagon dividam tensores grandes e aumenta o buffer dinâmico padrão para 512 MB.

NotaPor Publicado pelo Oossa: 1 min de leitura

O projeto llama.cpp lançou a versão b11490 em 2026‑10‑08. A atualização adiciona suporte à API "alloc_buffer_n" da Hexagon, permitindo dividir tensores grandes em vários buffers. O tamanho padrão do buffer dinâmico aumenta de 128 MB para 512 MB para evitar quedas de desempenho com modelos grandes. Uma nova opção, "--no-embd-offload", simplifica a linha de comando em dispositivos que não conseguem transferir embeddings. As mudanças foram coescritas por Jhen‑Jie Hong.

Por que importa

Desenvolvedores que usam hardware baseado em Hexagon podem executar modelos de linguagem maiores com mais eficiência, sem precisar ajustar os buffers manualmente.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.