OossaAI तेज़ी से विकसित हो रहा है। हम इसे आसान भाषा में समझाते हैं।

DeepSeek ने Huawei Ascend NPU के लिए DeepGEMM-Ascend जारी किया

नया रिपॉज़िटरी DeepGEMM को Ascend पर लाता है। यह BF16, FP8, FP4 GEMM और MegaMoE को सपोर्ट करता है और हार्डवेयर की लगभग पूरी क्षमता तक प्रदर्शन का दावा करता है।

संक्षिप्तOossa1 मिनट पढ़ना

DeepSeek AI ने DeepGEMM-Ascend नाम से नया GitHub रिपॉज़िटरी शुरू किया है। यह DeepGEMM मैट्रिक्स-मल्टिप्लाई लाइब्रेरी को Huawei के Ascend NPU पर उपलब्ध कराता है। यह पैकेज मूल DeepGEMM वाला ही API इस्तेमाल करता है, इसलिए NVIDIA GPU पर चलने वाले कोड को केवल pip install करके Ascend पर चलाया जा सकता है। यह BF16, FP8, FP4 GEMM, MQA logits और MegaMoE kernels को सपोर्ट करता है। कंपनी का दावा है कि Ascend 950 डिवाइस पर यह हार्डवेयर की अधिकतम क्षमता का 99.8% तक प्रदर्शन हासिल कर सकता है।

यह क्यों मायने रखता है

इससे डेवलपर Huawei के AI चिप्स पर मौजूदा DeepGEMM कोड का दोबारा इस्तेमाल कर सकते हैं। बड़े भाषा मॉडल की ट्रेनिंग और इन्फरेंस के लिए हार्डवेयर के विकल्प बढ़ेंगे।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।

स्रोत और संदर्भ

#स्रोतप्रकाशकतारीखमुख्य बात
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 सित॰ 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 स्रोत

अंतिम अपडेट: ·Markdown·llms.txt