DeepSeek AI ha aperto un nuovo repository su GitHub chiamato DeepGEMM-Ascend, che porta la libreria di moltiplicazione di matrici DeepGEMM sulle NPU Ascend di Huawei. Il pacchetto usa la stessa API di DeepGEMM originale, quindi il codice eseguito su GPU NVIDIA può essere adattato ad Ascend con un semplice comando pip install. Supporta kernel GEMM in BF16, FP8 e FP4, MQA logits e MegaMoE e dichiara di raggiungere fino al 99,8% dei limiti hardware sui dispositivi Ascend 950.
Perché conta
Consente agli sviluppatori di riutilizzare il codice DeepGEMM esistente sui chip AI di Huawei, ampliando le opzioni hardware per l’addestramento e l’inferenza dei modelli linguistici di grandi dimensioni.