DeepSeek AI abrió un nuevo repositorio en GitHub llamado DeepGEMM-Ascend. Este lleva la biblioteca de multiplicación de matrices DeepGEMM a las NPU Ascend de Huawei. El paquete utiliza la misma API que DeepGEMM original, por lo que el código que funciona en GPU NVIDIA puede adaptarse a Ascend con una simple instalación mediante pip. Admite GEMM en BF16, FP8 y FP4, logits MQA y kernels MegaMoE, y afirma alcanzar hasta el 99,8 % de los límites de rendimiento del hardware en los dispositivos Ascend 950.
Por qué importa
Permite a los desarrolladores reutilizar el código DeepGEMM existente en los chips de IA de Huawei, ampliando las opciones de hardware para entrenar e inferir con modelos de lenguaje grandes.