OossaKI entwickelt sich schnell. Wir erklären es einfach.

DeepSeek veröffentlicht DeepGEMM-Ascend für Huawei Ascend NPU

Das neue Repository portiert DeepGEMM auf Ascend und unterstützt BF16, FP8, FP4 GEMM und MegaMoE mit nahezu maximaler Hardwareleistung.

KurzmeldungOossa1 Min. Lesezeit

DeepSeek AI hat ein neues GitHub-Repository namens DeepGEMM-Ascend veröffentlicht. Es bringt die Matrixmultiplikationsbibliothek DeepGEMM auf Huaweis Ascend-NPUs. Das Paket nutzt dieselbe API wie das ursprüngliche DeepGEMM. Daher lässt sich Code, der auf NVIDIA-GPUs läuft, mit einer einfachen Installation über pip auf Ascend umstellen. Unterstützt werden BF16, FP8, FP4 GEMM, MQA-Logits und MegaMoE-Kernels. Laut DeepSeek erreicht die Software auf Ascend-950-Geräten bis zu 99,8 Prozent der Hardware-Leistungsgrenze.

Warum es wichtig ist

Entwickler können damit bestehenden DeepGEMM-Code auf Huaweis KI-Chips weiterverwenden. Das erweitert die Hardwareauswahl für das Training und die Inferenz großer Sprachmodelle.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29.09.2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 Quellen

Zuletzt aktualisiert: ·Markdown·llms.txt