Oossa

Cloudflare ने AI एजेंट्स के लिए ओपन-वेट निर्णय मॉडल जारी किए

Cloudflare के नए Clef मॉडल टेक्स्ट, JSON, इमेज या वीडियो का वर्गीकरण कर व्यवस्थित निर्णय देते हैं। 9B संस्करण की लेटेंसी 40 ms से कम है।

लेखक: Oossa द्वारा प्रकाशित: 1 मिनट पढ़ना

Growtika · Unsplash

8 Oct 2026 को अपने “Birthday Week” के दौरान Cloudflare ने Clef की घोषणा की। ये टेक्स्ट जनरेट करने के बजाय निर्णय लेने के लिए बनाए गए दो ओपन-वेट मॉडल हैं। कंपनी ने 27-billion-parameter वाला मल्टीमॉडल मॉडल और इसका छोटा 9-billion-parameter संस्करण Clef‑Flash, Workers AI के ज़रिए उपलब्ध कराया है। इनके वेट Hugging Face से डाउनलोड भी किए जा सकते हैं।

मॉडल कैसे काम करते हैं

Clef इनपुट के तौर पर किसी स्थिति का विवरण और अलग-अलग प्रकार के उत्तरों वाले सवालों का एक स्कीमा लेता है, फिर हर मान्य विकल्प के लिए उसकी संभावना बताता है। यह एक ही फ़ॉरवर्ड पास में टेक्स्ट, JSON, इमेज या वीडियो संभाल सकता है, इसलिए खुले प्रारूप में मिले आउटपुट को अलग से पार्स करने की ज़रूरत नहीं होती। 27B मॉडल में 64 k टोकन की कॉन्टेक्स्ट विंडो है—Typesafe के Jev जैसे तुलनीय मॉडल की क्षमता से दोगुनी।

प्रदर्शन और उपलब्धता

Cloudflare का कहना है कि उसके अपने बेंचमार्क में 9B Clef‑Flash मॉडल की मीडियन लेटेंसी 38.8 ms है, जबकि बड़े 27B मॉडल की लेटेंसी 209.3 ms है। ये मॉडल Cloudflare के एज GPU पर चलते हैं, इसलिए कंपनी को ज़रूरी निर्णयों के लिए नेटवर्क लेटेंसी कम रहने की उम्मीद है। डेवलपर नई सेवा के ज़रिए अपने डेटा से मॉडलों को फ़ाइन-ट्यून कर सकेंगे। शुरुआत में इसमें इंजीनियरों की मदद मिलेगी और बाद में यह सेल्फ-सर्विस सेवा बन जाएगी।

यह क्यों मायने रखता है

AI एजेंट बनाने वाले डेवलपर Clef की मदद से कस्टम पार्सर लिखे बिना तेज़ी से व्यवस्थित निर्णय ले सकते हैं। 9B मॉडल की कम लेटेंसी इसे सपोर्ट टिकट सही जगह भेजने या बॉट ट्रैफ़िक फ़िल्टर करने जैसे रियल-टाइम कामों के लिए उपयोगी बनाती है। ओपन-वेट रिलीज़ से टीमें मॉडल को अपने डेटा के मुताबिक ढाल सकती हैं।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।