ggml‑org/llama.cpp लाइब्रेरी का संस्करण b11475, 7 Oct 2026 को जारी हुआ। इसमें Metal (Apple GPU) बैकएंड की उस गड़बड़ी को ठीक किया गया है, जिसमें MUL_MAT+ADD ऑपरेशन को एक साथ जोड़ने पर गलत रेसिडुअल मैट्रिक्स चुना जा रहा था। इससे उन मॉडलों के नतीजे गलत आ रहे थे, जो एक ही चरण में कई मैट्रिक्स गुणा करते हैं। इस सुधार से एनकोडर सही ऑपरेन्ड चुनता है और Metal GPU पर सटीक आउटपुट मिलता है।
यह क्यों मायने रखता है
Apple GPU पर llama.cpp इस्तेमाल करने वाले डेवलपर अब पहले मिलने वाली एक जैसी संभावनाओं के बजाय भरोसेमंद मॉडल आउटपुट पा सकेंगे।