تیم ggml‑org نسخه b11293 llama.cpp را منتشر کرد. این نسخه عملیات یکانی، GLU، دودویی و مقیاسگذاری BF16 (قالب عددی با دقت نیمه) را برای CPU و CUDA اضافه میکند. همچنین هستههای CUDA بهروزرسانی شدهاند تا مشکل ساخت BF16 برطرف شود. این بهروزرسانی برای پلتفرمهای مختلف، از macOS و Windows گرفته تا Linux و Android، در دسترس است.
چرا مهم است
توسعهدهندگان اکنون میتوانند مدلهای llama.cpp را روی سختافزارهای پشتیبان BF16، مانند GPUهای جدیدتر، سریعتر اجرا کنند.