# DeepSeek veröffentlicht DeepGEMM-Ascend für Huawei Ascend NPU

> Das neue Repository portiert DeepGEMM auf Ascend und unterstützt BF16, FP8, FP4 GEMM und MegaMoE mit nahezu maximaler Hardwareleistung.

Oossa · 2026-09-30 · https://oossa.com/de/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

DeepSeek AI hat ein neues GitHub-Repository namens DeepGEMM-Ascend veröffentlicht. Es bringt die Matrixmultiplikationsbibliothek DeepGEMM auf Huaweis Ascend-NPUs. Das Paket nutzt dieselbe API wie das ursprüngliche DeepGEMM. Daher lässt sich Code, der auf NVIDIA-GPUs läuft, mit einer einfachen Installation über pip auf Ascend umstellen. Unterstützt werden BF16, FP8, FP4 GEMM, MQA-Logits und MegaMoE-Kernels. Laut DeepSeek erreicht die Software auf Ascend-950-Geräten bis zu 99,8 Prozent der Hardware-Leistungsgrenze.

## Die Fakten

- Erstveröffentlichung am 30.09.2026 angekündigt
- Unterstützt die Ascend-950-Serie, das CANN-9.20-Toolkit und torch_npu

## Warum es wichtig ist

Entwickler können damit bestehenden DeepGEMM-Code auf Huaweis KI-Chips weiterverwenden. Das erweitert die Hardwareauswahl für das Training und die Inferenz großer Sprachmodelle.

## Quellen und Referenzen

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

Zuletzt aktualisiert: 2026-09-30
