DeepSeek AI heeft een nieuwe GitHub-repository geopend: DeepGEMM-Ascend. Daarmee komt de matrixvermenigvuldigingsbibliotheek DeepGEMM beschikbaar voor Huawei’s Ascend-NPU’s. Het pakket gebruikt dezelfde API als de originele DeepGEMM, zodat code die op NVIDIA-GPU’s draait met een eenvoudige pip-installatie naar Ascend kan worden overgezet. Het ondersteunt BF16, FP8 en FP4 GEMM, MQA-logits en MegaMoE-kernels. Volgens DeepSeek haalt het op Ascend 950-apparaten tot 99,8% van de maximale hardwareprestaties.
Waarom het ertoe doet
Ontwikkelaars kunnen bestaande DeepGEMM-code hergebruiken op Huawei’s AI-chips. Dat vergroot de keuze aan hardware voor het trainen en uitvoeren van grote taalmodellen.