OossaAI는 빠르게 발전하고 있습니다. 저희가 쉽게 설명해 드립니다.

DeepSeek, 화웨이 Ascend용 DeepGEMM-Ascend 공개

새 저장소는 DeepGEMM을 Ascend로 이식해 BF16·FP8·FP4 GEMM과 MegaMoE를 지원하며, 하드웨어 최고 성능에 근접한 처리 속도를 제공한다.

짧은 소식Oossa1 분 읽기

DeepSeek AI가 DeepGEMM-Ascend라는 새 GitHub 저장소를 공개했다. 이 저장소는 행렬 곱셈 라이브러리 DeepGEMM을 화웨이 Ascend NPU에서 사용할 수 있도록 이식했다. 패키지는 기존 DeepGEMM과 동일한 API를 사용하므로, NVIDIA GPU에서 실행되는 코드를 pip install만으로 Ascend용으로 전환할 수 있다. BF16·FP8·FP4 GEMM, MQA 로짓, MegaMoE 커널을 지원하며 Ascend 950 기기에서 하드웨어 한계 성능의 최대 99.8%에 도달한다고 밝혔다.

왜 중요한가

개발자들이 기존 DeepGEMM 코드를 화웨이 AI 칩에서 재사용할 수 있어 대규모 언어 모델의 학습과 추론에 활용할 하드웨어 선택지가 넓어진다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

#출처매체날짜핵심 내용
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek2026. 9. 29.DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 개 출처

최종 업데이트: ·Markdown·llms.txt