OossaAI ontwikkelt zich snel. Wij leggen het eenvoudig uit.

DeepSeek brengt DeepGEMM-Ascend uit voor Huawei Ascend-NPU’s

De nieuwe repository brengt DeepGEMM naar Ascend en ondersteunt BF16, FP8, FP4 GEMM en MegaMoE, met prestaties dicht bij het hardwaremaximum.

Kort berichtOossa1 min lezen

DeepSeek AI heeft een nieuwe GitHub-repository geopend: DeepGEMM-Ascend. Daarmee komt de matrixvermenigvuldigingsbibliotheek DeepGEMM beschikbaar voor Huawei’s Ascend-NPU’s. Het pakket gebruikt dezelfde API als de originele DeepGEMM, zodat code die op NVIDIA-GPU’s draait met een eenvoudige pip-installatie naar Ascend kan worden overgezet. Het ondersteunt BF16, FP8 en FP4 GEMM, MQA-logits en MegaMoE-kernels. Volgens DeepSeek haalt het op Ascend 950-apparaten tot 99,8% van de maximale hardwareprestaties.

Waarom het ertoe doet

Ontwikkelaars kunnen bestaande DeepGEMM-code hergebruiken op Huawei’s AI-chips. Dat vergroot de keuze aan hardware voor het trainen en uitvoeren van grote taalmodellen.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Bronnen en referenties

#BronMediumDatumKernpunt
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 sep 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 bronnen

Laatst bijgewerkt: ·Markdown·llms.txt