DeepSeek AI a ouvert un nouveau dépôt GitHub appelé DeepGEMM-Ascend. Il porte la bibliothèque de multiplication de matrices DeepGEMM sur les NPU Huawei Ascend. Le paquet utilise la même API que DeepGEMM d’origine : le code qui fonctionne sur les GPU NVIDIA peut donc être adapté à Ascend par une simple installation avec pip. Il prend en charge BF16, FP8, FP4 GEMM, les logits MQA et les kernels MegaMoE, et affirme atteindre jusqu’à 99,8 % des capacités maximales du matériel sur les appareils Ascend 950.
Pourquoi c'est important
Les développeurs peuvent réutiliser leur code DeepGEMM existant sur les puces d’IA de Huawei, ce qui élargit les options matérielles pour l’entraînement et l’inférence des grands modèles de langage.