OossaA IA evolui rápido. Nós explicamos de forma simples.

DeepSeek lança DeepGEMM-Ascend para NPU da Huawei

O novo repositório porta o DeepGEMM para Ascend, com suporte a GEMM em BF16, FP8 e FP4 e ao MegaMoE, além de desempenho próximo ao limite do hardware.

NotaOossa1 min de leitura

A DeepSeek AI abriu um novo repositório no GitHub chamado DeepGEMM-Ascend. Ele leva a biblioteca de multiplicação de matrizes DeepGEMM para as NPUs Ascend da Huawei. O pacote usa a mesma API do DeepGEMM original, permitindo migrar para Ascend, com um simples pip install, códigos que rodam em GPUs da NVIDIA. Ele oferece suporte a GEMM em BF16, FP8 e FP4, logits de MQA e kernels MegaMoE, e afirma atingir até 99,8% dos limites de desempenho do hardware nos dispositivos Ascend 950.

Por que importa

A ferramenta permite que desenvolvedores reutilizem códigos existentes do DeepGEMM nos chips de IA da Huawei, ampliando as opções de hardware para treinar e executar modelos de linguagem de grande porte.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.

Fontes e referências

#FonteVeículoDataPonto principal
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 de set. de 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 fontes

Última atualização: ·Markdown·llms.txt