تیم ggml‑org نسخه b11398 از llama.cpp را منتشر کرد. این نسخه پردازش دنبالههای BF16، FP16 و FP32 را در بکاند tinyBLAS برای CPUهای مبتنی بر x86 پشتیبانی میکند. این دنبالهها همچنین برای محاسبات سریعتر برداریسازی شدهاند. فایلهای باینری آماده برای macOS (Apple Silicon و Intel)، iOS و چند معماری Ubuntu ارائه شدهاند. این بهروزرسانی شامل اصلاحاتی در آزمونهاست تا هنگام استفاده از پیادهسازیهای مرجع، مقایسهها دقیق باشند.
چرا مهم است
توسعهدهندگان اکنون میتوانند بدون شتابدهی GPU، استنتاج مدلهای زبانی بزرگ را روی پردازندههای معمولی سریعتر اجرا کنند.