DeepSeek AI har öppnat ett nytt kodarkiv på GitHub, DeepGEMM-Ascend. Det gör matrisoperationsbiblioteket DeepGEMM tillgängligt för Huaweis Ascend-NPU:er. Paketet använder samma API som det ursprungliga DeepGEMM, så kod som körs på NVIDIA-GPU:er kan flyttas till Ascend med en enkel pip-installation. Det stöder BF16, FP8 och FP4 GEMM, MQA-logits och MegaMoE-kärnor och uppges nå upp till 99,8 procent av Ascend 950-enheternas teoretiska prestandagräns.
Varför det spelar roll
Utvecklare kan återanvända befintlig DeepGEMM-kod på Huaweis AI-chip, vilket ger fler hårdvarualternativ för träning och inferens med stora språkmodeller.