DeepSeek AI hat ein neues GitHub-Repository namens DeepGEMM-Ascend veröffentlicht. Es bringt die Matrixmultiplikationsbibliothek DeepGEMM auf Huaweis Ascend-NPUs. Das Paket nutzt dieselbe API wie das ursprüngliche DeepGEMM. Daher lässt sich Code, der auf NVIDIA-GPUs läuft, mit einer einfachen Installation über pip auf Ascend umstellen. Unterstützt werden BF16, FP8, FP4 GEMM, MQA-Logits und MegaMoE-Kernels. Laut DeepSeek erreicht die Software auf Ascend-950-Geräten bis zu 99,8 Prozent der Hardware-Leistungsgrenze.
Warum es wichtig ist
Entwickler können damit bestehenden DeepGEMM-Code auf Huaweis KI-Chips weiterverwenden. Das erweitert die Hardwareauswahl für das Training und die Inferenz großer Sprachmodelle.