# DeepSeek släpper DeepGEMM-Ascend för Huawei Ascend NPU

> Det nya kodarkivet porterar DeepGEMM till Ascend och stöder BF16, FP8, FP4 GEMM och MegaMoE med prestanda nära hårdvarans toppnivå.

Oossa · 2026-09-30 · https://oossa.com/sv/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

DeepSeek AI har öppnat ett nytt kodarkiv på GitHub, DeepGEMM-Ascend. Det gör matrisoperationsbiblioteket DeepGEMM tillgängligt för Huaweis Ascend-NPU:er. Paketet använder samma API som det ursprungliga DeepGEMM, så kod som körs på NVIDIA-GPU:er kan flyttas till Ascend med en enkel pip-installation. Det stöder BF16, FP8 och FP4 GEMM, MQA-logits och MegaMoE-kärnor och uppges nå upp till 99,8 procent av Ascend 950-enheternas teoretiska prestandagräns.

## Fakta

- Den första versionen tillkännagavs 2026-09-30
- Stöder Ascend 950-serien, verktygslådan CANN 9.20 och torch_npu

## Varför det spelar roll

Utvecklare kan återanvända befintlig DeepGEMM-kod på Huaweis AI-chip, vilket ger fler hårdvarualternativ för träning och inferens med stora språkmodeller.

## Källor och referenser

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

Senast uppdaterad: 2026-09-30
