# DeepSeek lance DeepGEMM-Ascend pour les NPU Huawei Ascend

> Ce nouveau dépôt porte DeepGEMM sur Ascend et prend en charge BF16, FP8, FP4 GEMM et MegaMoE, avec des performances proches du maximum théorique du matériel.

Oossa · 2026-09-30 · https://oossa.com/fr/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

DeepSeek AI a ouvert un nouveau dépôt GitHub appelé DeepGEMM-Ascend. Il porte la bibliothèque de multiplication de matrices DeepGEMM sur les NPU Huawei Ascend. Le paquet utilise la même API que DeepGEMM d’origine : le code qui fonctionne sur les GPU NVIDIA peut donc être adapté à Ascend par une simple installation avec pip. Il prend en charge BF16, FP8, FP4 GEMM, les logits MQA et les kernels MegaMoE, et affirme atteindre jusqu’à 99,8 % des capacités maximales du matériel sur les appareils Ascend 950.

## Les faits

- Première version annoncée le 2026-09-30
- Compatible avec la série Ascend 950, la boîte à outils CANN 9.20 et torch_npu

## Pourquoi c'est important

Les développeurs peuvent réutiliser leur code DeepGEMM existant sur les puces d’IA de Huawei, ce qui élargit les options matérielles pour l’entraînement et l’inférence des grands modèles de langage.

## Sources et références

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

Dernière mise à jour: 2026-09-30
