ggml‑org टीम ने 2026-10-09 को llama.cpp संस्करण b11527 जारी किया। इस अपडेट में WebGPU के सभी ऑपरेशन अब 2D वर्कग्रुप डिस्पैच का इस्तेमाल करते हैं और पुरानी 1D विधि हटा दी गई है। इसमें macOS (Apple Silicon और Intel), iOS और Ubuntu के कई कॉन्फ़िगरेशन के लिए नए प्री-कम्पाइल्ड बाइनरी भी शामिल हैं, जिनमें Vulkan और CUDA बिल्ड शामिल हैं। इन बदलावों का मकसद ब्राउज़र में GPU का प्रदर्शन बेहतर करना और समर्थित डिवाइस पर सेटअप आसान बनाना है।
यह क्यों मायने रखता है
डेवलपर कस्टम कर्नल कोड लिखे बिना WebGPU-सक्षम ब्राउज़र में LLM तेज़ी से चला सकते हैं।