Oossa

llama.cpp में टेंसर कॉपी घटाने का मेमोरी-मैप विकल्प

ओपन-सोर्स LLM रनटाइम अब मॉडल का डेटा सीधे मैप करने देता है, जिससे macOS, iOS और Linux बिल्ड में RAM की बचत होती है।

संक्षिप्तOossaOossa द्वारा प्रकाशित: 1 मिनट पढ़ना

ggml-org टीम ने llama.cpp का b11324 संस्करण जारी किया है। इस अपडेट में मेमोरी-मैप मोड जोड़ा गया है, जिससे मॉडल लोड करते समय हर टेंसर की पूरी आकार वाली दूसरी कॉपी बनाने की ज़रूरत नहीं पड़ती। यह बदलाव macOS (Apple Silicon और Intel), iOS और Ubuntu के कई बिल्ड के नए बाइनरी पैकेज में उपलब्ध है। रिलीज़ में Claude और NVIDIA के इंजीनियर Pranesh Gonegandla के योगदान का भी उल्लेख है।

यह क्यों मायने रखता है

डेवलपर उसी हार्डवेयर पर बड़े भाषा मॉडल चला सकते हैं। इससे सीमित मेमोरी वाले शौकीनों और छोटी टीमों को मदद मिलती है।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।