Oossa

llama.cpp b11493 añade compatibilidad con grouped MoE XMX GEMM

La biblioteca de código abierto llama.cpp publicó la versión b11493 el 8 de octubre de 2026, con una nueva operación grouped MoE XMX GEMM basada en SYCL y binarios para varias plataformas.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml-org publicó la versión b11493 de llama.cpp el 8 de octubre de 2026. La actualización incorpora una implementación en SYCL de grouped Mixture-of-Experts (MoE) XMX GEMM, una multiplicación de matrices que se usa en los modelos de lenguaje grandes. El lanzamiento también incluye binarios precompilados para macOS, iOS y Ubuntu (CPU, Vulkan y CUDA).

Por qué importa

Los desarrolladores ya pueden ejecutar modelos basados en MoE en GPU compatibles con SYCL, lo que amplía las opciones de hardware para las cargas de trabajo de LLM de código abierto.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.