# DeepSeek، DeepGEMM-Ascend را برای NPUهای هواوی عرضه کرد

> مخزن جدید، DeepGEMM را به Ascend منتقل می‌کند و از BF16، FP8، FP4 GEMM و MegaMoE با عملکردی نزدیک به حداکثر توان سخت‌افزار پشتیبانی می‌کند.

Oossa · 2026-09-30 · https://oossa.com/fa/deepseek-releases-deepgemm-ascend-for-huawei-ascend-npu

DeepSeek AI مخزن جدیدی با نام DeepGEMM-Ascend در GitHub منتشر کرد. این مخزن کتابخانه ضرب ماتریسی DeepGEMM را به NPUهای Ascend هواوی می‌آورد. این بسته از همان API نسخه اصلی DeepGEMM استفاده می‌کند؛ بنابراین می‌توان کدی را که روی GPUهای NVIDIA اجرا می‌شود، تنها با اجرای یک دستور pip install به Ascend منتقل کرد. DeepGEMM-Ascend از BF16، FP8، FP4 GEMM، لاجیت‌های MQA و کرنل‌های MegaMoE پشتیبانی می‌کند و مدعی است روی دستگاه‌های Ascend 950 به ۹۹٫۸ درصد از توان سخت‌افزاری می‌رسد.

## حقایق

- عرضه اولیه در 2026‑09‑30 اعلام شد
- از سری Ascend 950، ابزار CANN 9.20 و torch_npu پشتیبانی می‌کند

## چرا مهم است

این ابزار به توسعه‌دهندگان امکان می‌دهد کدهای فعلی DeepGEMM را روی تراشه‌های هوش مصنوعی هواوی هم به کار بگیرند و گزینه‌های سخت‌افزاری بیشتری برای آموزش و استنتاج مدل‌های زبانی بزرگ داشته باشند.

## منابع و ارجاع‌ها

1. [New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs](https://github.com/deepseek-ai/DeepGEMM-Ascend) – DeepSeek, 2026-09-29

آخرین به‌روزرسانی: 2026-09-30
