Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

DeepSeek، DeepGEMM-Ascend را برای NPUهای هواوی عرضه کرد

مخزن جدید، DeepGEMM را به Ascend منتقل می‌کند و از BF16، FP8، FP4 GEMM و MegaMoE با عملکردی نزدیک به حداکثر توان سخت‌افزار پشتیبانی می‌کند.

خبر کوتاهOossa1 دقیقه مطالعه

DeepSeek AI مخزن جدیدی با نام DeepGEMM-Ascend در GitHub منتشر کرد. این مخزن کتابخانه ضرب ماتریسی DeepGEMM را به NPUهای Ascend هواوی می‌آورد. این بسته از همان API نسخه اصلی DeepGEMM استفاده می‌کند؛ بنابراین می‌توان کدی را که روی GPUهای NVIDIA اجرا می‌شود، تنها با اجرای یک دستور pip install به Ascend منتقل کرد. DeepGEMM-Ascend از BF16، FP8، FP4 GEMM، لاجیت‌های MQA و کرنل‌های MegaMoE پشتیبانی می‌کند و مدعی است روی دستگاه‌های Ascend 950 به ۹۹٫۸ درصد از توان سخت‌افزاری می‌رسد.

چرا مهم است

این ابزار به توسعه‌دهندگان امکان می‌دهد کدهای فعلی DeepGEMM را روی تراشه‌های هوش مصنوعی هواوی هم به کار بگیرند و گزینه‌های سخت‌افزاری بیشتری برای آموزش و استنتاج مدل‌های زبانی بزرگ داشته باشند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1New repository deepseek-ai/DeepGEMM-Ascend: DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs ↗DeepSeek۷ مهر ۱۴۰۵DeepGEMM-Ascend: clean and efficient matrix multiplication kernel library for Huawei Ascend NPUs

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt