OossaAI utvecklas fort. Vi förklarar det enkelt.

DeepSeek släpper DeepGEMM-Ascend för Huawei Ascend NPU

Det nya kodarkivet porterar DeepGEMM till Ascend och stöder BF16, FP8, FP4 GEMM och MegaMoE med prestanda nära hårdvarans toppnivå.

NotisOossa1 min läsning

DeepSeek AI har öppnat ett nytt kodarkiv på GitHub, DeepGEMM-Ascend. Det gör matrisoperationsbiblioteket DeepGEMM tillgängligt för Huaweis Ascend-NPU:er. Paketet använder samma API som det ursprungliga DeepGEMM, så kod som körs på NVIDIA-GPU:er kan flyttas till Ascend med en enkel pip-installation. Det stöder BF16, FP8 och FP4 GEMM, MQA-logits och MegaMoE-kärnor och uppges nå upp till 99,8 procent av Ascend 950-enheternas teoretiska prestandagräns.

Varför det spelar roll

Utvecklare kan återanvända befintlig DeepGEMM-kod på Huaweis AI-chip, vilket ger fler hårdvarualternativ för träning och inferens med stora språkmodeller.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 sep. 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 källor

Senast uppdaterad: ·Markdown·llms.txt