OossaLa IA avanza rápido. Te lo explicamos de forma sencilla.

DeepSeek lanza DeepGEMM-Ascend para las NPU Huawei Ascend

El nuevo repositorio lleva DeepGEMM a Ascend y admite GEMM en BF16, FP8 y FP4, además de MegaMoE, con un rendimiento cercano al máximo del hardware.

BreveOossa1 min de lectura

DeepSeek AI abrió un nuevo repositorio en GitHub llamado DeepGEMM-Ascend. Este lleva la biblioteca de multiplicación de matrices DeepGEMM a las NPU Ascend de Huawei. El paquete utiliza la misma API que DeepGEMM original, por lo que el código que funciona en GPU NVIDIA puede adaptarse a Ascend con una simple instalación mediante pip. Admite GEMM en BF16, FP8 y FP4, logits MQA y kernels MegaMoE, y afirma alcanzar hasta el 99,8 % de los límites de rendimiento del hardware en los dispositivos Ascend 950.

Por qué importa

Permite a los desarrolladores reutilizar el código DeepGEMM existente en los chips de IA de Huawei, ampliando las opciones de hardware para entrenar e inferir con modelos de lenguaje grandes.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.

Fuentes y referencias

#FuenteMedioFechaIdea clave
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 sept 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 fuentes

Última actualización: ·Markdown·llms.txt