# llama.cpp پشتیبانی CPU از ورودی ماتریسی BF16 را اصلاح کرد

> نسخه b11292 پشتیبانی CPU از ورودی ماتریسی BF16 را که در کانولوشن عمقی استفاده می‌شود اضافه می‌کند و بررسی‌های پشتیبانی Vulkan را دقیق‌تر می‌کند.

Oossa · 2026-09-30 · https://oossa.com/fa/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

با کمک هوش مصنوعی تهیه و ترجمه شده است. منابع اصلی زیر را بررسی کنید.

نسخه b11292 در llama.cpp محدودیتی در بک‌اند CPU را برطرف می‌کند که هنگام اجرای کانولوشن عمقی یک‌بعدی با کرنلِ دارای BF16، قالب عددی ۱۶بیتی، مشکل‌ساز می‌شد. بک‌اند CPU حالا این ورودی را برای محاسبه به ممیز شناور ۳۲بیتی تبدیل می‌کند و به این ترتیب، محاسبات با کرنل ضرب ماتریسی-برداری Metal هم‌خوان می‌شود.

این نسخه همچنین بررسی‌های Vulkan را تغییر می‌دهد: BF16 را به‌عنوان ورودی دوم ماتریس فقط زمانی می‌پذیرد که ورودی اول هم BF16 باشد. ترکیب‌های دیگر پشتیبانی‌نشده محسوب می‌شوند تا زمان‌بند آن‌ها را روی CPU اجرا کند. در یادداشت‌های انتشار به اضافه‌شدن آزمون‌ها اشاره شده، اما مشخص نشده این تغییرات چه زمانی به برنامه‌های بسته‌بندی‌شده می‌رسند یا کدام کاربران آن‌ها را دریافت می‌کنند.

## حقایق

- نسخه llama.cpp b11292 در September 30, 2026 منتشر شد.
- یادداشت‌ها شامل آزمونی برای کانولوشن عمقی با کرنل‌های F32، F16 و BF16 و نیز سه حالت ضرب ماتریسی با BF16 به‌عنوان ورودی دوم است.

## چرا مهم است

برای توسعه‌دهندگانی که کانولوشن عمقی BF16 را اجرا می‌کنند، بک‌اند CPU حالا می‌تواند ترکیبی را پردازش کند که پیش‌تر نمی‌پذیرفت؛ یادداشت‌ها مشخص نمی‌کنند این اصلاح چه زمانی در برنامه‌های پایین‌دستی ارائه خواهد شد.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

آخرین به‌روزرسانی: 2026-09-30
