OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.

DeepSeek rilascia DeepGEMM-Ascend per le NPU Huawei Ascend

Il nuovo repository porta DeepGEMM su Ascend e supporta GEMM in BF16, FP8 e FP4 e MegaMoE, con prestazioni vicine al picco teorico dell’hardware.

BreveOossa1 min di lettura

DeepSeek AI ha aperto un nuovo repository su GitHub chiamato DeepGEMM-Ascend, che porta la libreria di moltiplicazione di matrici DeepGEMM sulle NPU Ascend di Huawei. Il pacchetto usa la stessa API di DeepGEMM originale, quindi il codice eseguito su GPU NVIDIA può essere adattato ad Ascend con un semplice comando pip install. Supporta kernel GEMM in BF16, FP8 e FP4, MQA logits e MegaMoE e dichiara di raggiungere fino al 99,8% dei limiti hardware sui dispositivi Ascend 950.

Perché conta

Consente agli sviluppatori di riutilizzare il codice DeepGEMM esistente sui chip AI di Huawei, ampliando le opzioni hardware per l’addestramento e l’inferenza dei modelli linguistici di grandi dimensioni.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 set 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt