پروژه ggml‑org/llama.cpp نسخه b11516 را در 2026‑10‑09 منتشر کرد. این بهروزرسانی باگی را در مسیر NPUهای Hexagon برطرف میکند که باعث سرریز حلقه DMA و در نتیجه دادههای قدیمی و خروجیهای NaN/inf میشد. حالا وقتی حلقه پر است، کد قدیمیترین توصیفگر را حذف میکند و بعدتر صف را تخلیه میکند. آزمونهایی با عملیات بزرگ patch-embed اکنون روی سختافزار Hexagon با موفقیت اجرا میشوند.
چرا مهم است
توسعهدهندگانی که از llama.cpp روی دستگاههای Qualcomm Hexagon استفاده میکنند، بهجای NaNهای نادرست، خروجیهای صحیح مدل را دریافت خواهند کرد.