# DeepSeek, 화웨이 Ascend용 DeepGEMM-Ascend 공개

> 새 저장소는 DeepGEMM을 Ascend로 이식해 BF16·FP8·FP4 GEMM과 MegaMoE를 지원하며, 하드웨어 최고 성능에 근접한 처리 속도를 제공한다.

Oossa · 2026-09-30 · https://oossa.com/ko/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

DeepSeek AI가 DeepGEMM-Ascend라는 새 GitHub 저장소를 공개했다. 이 저장소는 행렬 곱셈 라이브러리 DeepGEMM을 화웨이 Ascend NPU에서 사용할 수 있도록 이식했다. 패키지는 기존 DeepGEMM과 동일한 API를 사용하므로, NVIDIA GPU에서 실행되는 코드를 pip install만으로 Ascend용으로 전환할 수 있다. BF16·FP8·FP4 GEMM, MQA 로짓, MegaMoE 커널을 지원하며 Ascend 950 기기에서 하드웨어 한계 성능의 최대 99.8%에 도달한다고 밝혔다.

## 팩트

- 최초 공개일: 2026년 9월 30일
- Ascend 950 시리즈, CANN 9.20 툴킷, torch_npu 지원

## 왜 중요한가

개발자들이 기존 DeepGEMM 코드를 화웨이 AI 칩에서 재사용할 수 있어 대규모 언어 모델의 학습과 추론에 활용할 하드웨어 선택지가 넓어진다.

## 출처 및 참고 자료

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

최종 업데이트: 2026-09-30
