OossaL'IA évolue vite. Nous l'expliquons simplement.

DeepSeek lance DeepGEMM-Ascend pour les NPU Huawei Ascend

Ce nouveau dépôt porte DeepGEMM sur Ascend et prend en charge BF16, FP8, FP4 GEMM et MegaMoE, avec des performances proches du maximum théorique du matériel.

BrèveOossa1 min de lecture

DeepSeek AI a ouvert un nouveau dépôt GitHub appelé DeepGEMM-Ascend. Il porte la bibliothèque de multiplication de matrices DeepGEMM sur les NPU Huawei Ascend. Le paquet utilise la même API que DeepGEMM d’origine : le code qui fonctionne sur les GPU NVIDIA peut donc être adapté à Ascend par une simple installation avec pip. Il prend en charge BF16, FP8, FP4 GEMM, les logits MQA et les kernels MegaMoE, et affirme atteindre jusqu’à 99,8 % des capacités maximales du matériel sur les appareils Ascend 950.

Pourquoi c'est important

Les développeurs peuvent réutiliser leur code DeepGEMM existant sur les puces d’IA de Huawei, ce qui élargit les options matérielles pour l’entraînement et l’inférence des grands modèles de langage.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.

Sources et références

#SourceMédiaDateÀ retenir
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 sept. 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 sources

Dernière mise à jour: ·Markdown·llms.txt