Oossa

llama.cpp añade una opción de mapeo de memoria para reducir copias de tensores

El entorno de ejecución de LLM de código abierto permite ahora mapear directamente los datos del modelo y ahorrar RAM en las versiones para macOS, iOS y Linux.

BreveOossaPublicado por Oossa: 1 min de lectura

El equipo de ggml-org publicó la versión b11324 de llama.cpp. La actualización incorpora un modo de mapeo de memoria que evita crear una segunda copia completa de cada tensor al cargar modelos. La función está disponible en los nuevos paquetes binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu. En las notas de la versión también se reconocen las contribuciones de Claude y de Pranesh Gonegandla, ingeniero de NVIDIA.

Por qué importa

Los desarrolladores pueden ejecutar modelos de lenguaje más grandes con el mismo hardware, algo útil para aficionados y equipos pequeños con memoria limitada.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.