OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

DeepSeek, Huawei Ascend NPU’lar için DeepGEMM-Ascend’i çıkardı

Yeni depo, DeepGEMM’i Ascend’e taşıyor; BF16, FP8 ve FP4 GEMM ile MegaMoE’yi donanımın tepe performansına yakın hızlarda destekliyor.

Kısa haberOossa1 dk okuma

DeepSeek AI, DeepGEMM-Ascend adlı yeni bir GitHub deposunu kullanıma açtı. Depo, DeepGEMM matris çarpımı kütüphanesini Huawei’nin Ascend NPU’larına taşıyor. Paket, orijinal DeepGEMM ile aynı API’yi kullanıyor; böylece NVIDIA GPU’larda çalışan kod, basit bir pip install komutuyla Ascend’e geçirilebiliyor. BF16, FP8 ve FP4 GEMM’i, MQA logits’i ve MegaMoE çekirdeklerini destekleyen paket, Ascend 950 cihazlarında donanım sınırlarının yüzde 99,8’ine kadar performans sunduğunu öne sürüyor.

Neden önemli

Geliştiricilerin mevcut DeepGEMM kodlarını Huawei’nin yapay zekâ çiplerinde yeniden kullanmasını sağlayarak büyük dil modellerinin eğitimi ve çıkarımı için donanım seçeneklerini artırıyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek29 Eyl 2026DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 kaynak

Son güncelleme: ·Markdown·llms.txt