Oossa

llama.cpp v0.2.0 corrige la lentitud en GPU AMD integrada

La biblioteca de código abierto para ejecutar modelos LLaMA incorpora una corrección para Vulkan en gráficos integrados de AMD y actualiza los binarios precompilados para macOS, iOS y Linux.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml-org publicó llama.cpp versión b11461 el 2026-10-07. La actualización corrige la lectura lenta de puntos de control al usar Vulkan en GPU AMD integrada. También ofrece nuevos paquetes binarios para Apple Silicon, Mac con Intel, iOS y varias versiones de Linux (CPU, Vulkan, CUDA 12.8). Los usuarios pueden descargar el archivo correspondiente desde la página de lanzamientos de GitHub.

Por qué importa

Los usuarios de portátiles AMD ahora pueden ejecutar modelos LLaMA más rápido, sin la ralentización anterior.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.