# DeepSeek lança DeepGEMM-Ascend para NPU da Huawei

> O novo repositório porta o DeepGEMM para Ascend, com suporte a GEMM em BF16, FP8 e FP4 e ao MegaMoE, além de desempenho próximo ao limite do hardware.

Oossa · 2026-09-30 · https://oossa.com/pt/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

A DeepSeek AI abriu um novo repositório no GitHub chamado DeepGEMM-Ascend. Ele leva a biblioteca de multiplicação de matrizes DeepGEMM para as NPUs Ascend da Huawei. O pacote usa a mesma API do DeepGEMM original, permitindo migrar para Ascend, com um simples pip install, códigos que rodam em GPUs da NVIDIA. Ele oferece suporte a GEMM em BF16, FP8 e FP4, logits de MQA e kernels MegaMoE, e afirma atingir até 99,8% dos limites de desempenho do hardware nos dispositivos Ascend 950.

## Os fatos

- Lançamento inicial anunciado em 2026‑09‑30
- Compatível com a série Ascend 950, o kit de ferramentas CANN 9.20 e torch_npu

## Por que importa

A ferramenta permite que desenvolvedores reutilizem códigos existentes do DeepGEMM nos chips de IA da Huawei, ampliando as opções de hardware para treinar e executar modelos de linguagem de grande porte.

## Fontes e referências

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

Última atualização: 2026-09-30
