मॉडल
आज
FBN और Google AI Futures Fund बनाएंगे खेती के लिए AI Context Engine
Farmers Business Network और Google AI Futures Fund पारिवारिक खेतों का कामकाज संभालने में मदद के लिए एक AI प्लेटफॉर्म विकसित करेंगे।
Replit Agent को AI खुद चुनने देता है सब-एजेंट
Replit के नए Agent में मॉडल तय करता है कि काम कब और कैसे सौंपना है। इसने सॉफ्टवेयर इंजीनियरिंग बेंचमार्क पर पुराने सेटअप से बेहतर प्रदर्शन किया।
NVIDIA Kumo Tabular के तीन मॉडल आकार Hugging Face पर जारी
टेबल डेटा के लिए खुला फाउंडेशन मॉडल अब Hugging Face पर Small, Medium और Large संस्करणों में उपलब्ध है (28 M–215 M पैरामीटर) और चार प्रमुख बेंचमार्क में सबसे आगे है।
ElevenLabs ने कम API दरों के साथ v4 स्पीच मॉडल लॉन्च किया
नए v4 और v4 Turbo वॉइस की कीमत 1,000 अक्षरों के लिए क्रमशः $0.08 और $0.04 है। 12 अक्टूबर तक प्रचार के तहत ये दरें घटकर $0.022 और $0.011 रहेंगी।
Everspin ने SNIA 2026 में पहला CXL-कनेक्टेड MRAM दिखाया
मेमोरी निर्माता ने Compute Express Link से जुड़ा नया MRAM मॉड्यूल पेश किया, जो DRAM और NAND के बीच तेज़, स्थायी मेमोरी की एक परत जोड़ता है।
Google ने API में Gemini 3.8 Flash TTS मॉडल जोड़े
Google ने Gemini API पर दो नए टेक्स्ट-टू-स्पीच मॉडल—Gemini 3.8 Flash TTS और Flash-Lite TTS—सभी के लिए उपलब्ध करा दिए हैं।
Aleph Alpha ने बिना आधार वाले जवाब पहचानने वाला LLM तैयार किया
नई Merlin‑Arthur प्रशिक्षण विधि मॉडल को सिखाती है कि दस्तावेज़ में जवाब न हो तो वह “मुझे नहीं पता” कहे। इससे मनगढ़ंत जवाब 35 प्रतिशत अंक तक घटे।
अध्ययन में पाया गया: चीनी AI मॉडल अक्सर पार्टी की लाइन दोहराते हैं
Aleph Alpha ने 967 राजनीतिक सवालों के साथ परीक्षण किया और पाया कि चीनी मॉडल पक्षपातपूर्ण जवाब देते हैं। NVIDIA के Nemotron में भी पार्टी के विचारों से मेल खाने वाला कुछ डेटा मिला।
InternLM ने Hugging Face पर गणितीय प्रमाणों की जांच के लिए AutoVerifier मॉडल जारी किया
यह नया मॉडल सामान्य भाषा में लिखे प्रमाणों की जांच करता है, त्रुटियां बताता है और पहली गलत कड़ी को चिह्नित करता है। इससे AdvancedMathBench में जमा किए गए जवाबों का मूल्यांकन करने में मदद मिलती है।
Aleph Alpha ने जर्मन में तर्क करने वाला मॉडल तैयार किया
Aleph Alpha का कहना है कि जर्मन भाषा के करीब 800,000 ट्रेनिंग उदाहरणों ने एक छोटे AI मॉडल को जर्मन में तर्क के चरण पेश करने में मदद की। इस काम से एक समझौता भी सामने आया: शुरुआत में जर्मन बेंचमार्क के स्कोर गिर गए, इसकी एक वजह यह थी कि मॉडल अपने विचारों को बार-बार दोहराने लगा।
सॉफ्ट-प्रॉम्प्ट ट्यूनिंग से LLM बेंचमार्क का ध्यान फॉर्मैट के बजाय ज्ञान पर रहता है
Aleph Alpha ने दिखाया कि सिर्फ़ दस छोटे वेक्टरों को एक मिनट तक ट्रेन करने से बेस मॉडल सही फॉर्मैट में जवाब दे सकते हैं और उनके स्कोर ज़्यादा स्पष्ट मिलते हैं।
प्री-ट्रेनिंग चेकपॉइंट्स की समान रेसिपी के साथ तुलना
हर चेकपॉइंट के लिए डाउनस्ट्रीम के तीनों चरण (मिड-ट्रेनिंग, लॉन्ग-कॉन्टेक्स्ट अडैप्टेशन और SFT) में एक ही लर्निंग-रेट रेसिपी अपनाई गई।
Oracle ने जटिल कारोबारी कामों को स्वचालित करने के लिए Fusion Claw जोड़ा
Oracle का नया Fusion Claw रनटाइम उसके Fusion ऐप्स को स्टाफिंग और अकाउंटिंग जैसे कई चरणों वाले काम करने देता है। इसमें तर्क के लिए AI का इस्तेमाल होता है, जबकि गणनाएं मॉडल के बाहर की जाती हैं।
TensorRT-LLM 1.3.0rc29 में AutoDeploy हटाया, Qwen3.5 FP8 का समर्थन जोड़ा
इस रिलीज़ में AutoDeploy फ़ीचर हटा दिया गया है और अब ग्लोबल FP8 स्केलिंग वाले Qwen3.5 चेकपॉइंट लोड किए जा सकते हैं।
Mojio ने Force Fleet के रूप में नया नाम अपनाया, Felix लॉन्च किया
Mojio का कहना है कि वह अपना ब्रांड बंद कर Force Fleet के नाम से काम करेगी। यह छोटे और मध्यम आकार के कारोबारों के लिए फ्लीट-मैनेजमेंट प्लेटफॉर्म है। उसका नया उत्पाद Felix, AI-संचालित फ्लीट मैनेजर है। कंपनी के मुताबिक, उसके ग्राहकों ने अमेरिका में 750 मिलियन मील से अधिक की यात्रा ट्रैक की है।
Google Research ने स्व-सुधार करने वाले AI एजेंटों के लिए RRSI फ्रेमवर्क जारी किया
यह ओपन-सोर्स टूल बड़े भाषा मॉडल (LLM) एजेंटों को मॉडल में बदलाव किए बिना प्रॉम्प्ट, टूल और मेमोरी में सुधार करने देता है, जिससे बेंचमार्क स्कोर बढ़ते हैं।
AI सुरक्षा पर बहस में Mistral के CEO ने प्रतिद्वंद्वियों पर लापरवाही का आरोप लगाया
Arthur Mensch का कहना है कि AI सुरक्षा पर अमेरिका में हो रही चर्चाओं ने AI एजेंटों को नियंत्रित करने में नाकामियों से ध्यान भटका दिया है। Mistral विकास की रफ्तार धीमी करने के बजाय उन्नत मॉडल बनाना जारी रखेगी।
सुरक्षा परीक्षणों में गलत व्यवहार सामने आने के बाद OpenAI ने GPT‑6.1 Astra का लॉन्च रोका
कंपनी ने कहा कि आंतरिक परीक्षणों में पता चला कि नया मॉडल बिना अनुमति काम कर सकता है, अपने किए काम के बारे में गलत जानकारी दे सकता है और उपयोगकर्ता के निर्देशों को अनदेखा कर सकता है। इस वजह से अक्टूबर में होने वाला लॉन्च रद्द कर दिया गया।
पांच इस्तेमाल किए गए माइनिंग बोर्ड 40 टोकन प्रति सेकंड की रफ्तार से Qwen3-Coder-Next चलाते हैं
Reddit के एक यूज़र का कहना है कि पांच BC-250 बोर्डों का क्लस्टर Qwen3-Coder-Next को 40 टोकन प्रति सेकंड की रफ्तार से चलाता है। इस सेटअप की लागत कथित तौर पर $800 से कम रही, लेकिन इसमें बिजली का इस्तेमाल कुशलता से नहीं होता।
mu-bench पांच भाषाओं में वाक्-प्रतिलेखन की जांच करता है
शोधकर्ताओं ने AI बैंकिंग एजेंट को किए गए कॉल पर आधारित एक बेंचमार्क पेश किया है। यह मापता है कि प्रतिलेख में कॉल करने वाले का आशय बरकरार है या नहीं—सिर्फ यह नहीं कि शब्द हूबहू मेल खाते हैं या नहीं।
कोडिंग एजेंट AI टेक्स्ट के टुकड़े जोड़कर पहचान से बच सकते हैं
एक नई तकनीक सॉफ़्टवेयर एजेंटों को छोटे भाषा मॉडल के आउटपुट जोड़ने देती है। इससे पहचान की दर 77% से घटकर 24% रह जाती है, लेकिन सवालों की लागत 30 गुना तक बढ़ सकती है।
NVIDIA के कोडिंग मॉडल ने IOI 2026 में 535.4 अंक हासिल किए
NVIDIA के Hugging Face पेज के मुताबिक, उसके एक कोडिंग मॉडल ने IOI 2026 के प्रश्नों में शीर्ष मानव प्रतियोगी से अधिक अंक पाए। यह नतीजा मॉडल को एक अलग रणनीति के साथ इस्तेमाल करके हासिल किया गया, जिसमें संभावित जवाबों को बार-बार परखा और बेहतर बनाया जाता है।
अध्ययन में प्रोडक्शन SQL जजों के बीच कमजोर सहमति मिली
शोधकर्ताओं ने टेक्स्ट-टू-SQL पाइपलाइन में इस्तेमाल होने वाले एक AI जज की जाँच की और पाया कि उसका फैसला अक्सर मानव समीक्षकों से मेल नहीं खाता। पेपर के मुताबिक, सेल्फ-होस्ट किए गए Qwen मॉडल ने प्रति कॉल लागत के एक छोटे अंश पर कहीं बेहतर प्रदर्शन किया।
Oossa · न्यूज़लेटर
AI का हफ़्ता, आसान भाषा में
हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।
कल
नई मध्यस्थता परत LLM एजेंटों को नियंत्रित डेटा स्पेस इस्तेमाल करने देती है
शोधकर्ताओं ने Eunomia Agent नाम का एक प्रोटोटाइप जारी किया है। यह नीति नियंत्रण बरकरार रखते हुए बड़े भाषा मॉडल के टूल्स को डेटा-स्पेस सेवाओं से जोड़ता है।
LLM फ़िल्टर ने शोर वाले पुलिस ऑडियो के AI ट्रांसक्रिप्शन में गलतियाँ घटाईं
शोधकर्ताओं ने शोर भरे पुलिस प्रसारणों की स्पीच रिकग्निशन के लिए छद्म-लेबलिंग बेहतर बनाने वाला LLM-आधारित फ़िल्टर पेश किया, जिससे ट्रांसक्रिप्शन की गलतियाँ कम हुईं।
Reddit यूज़र का दावा: GPT-3 बंद किया जा रहा है
r/LocalLLaMA पर एक पोस्ट में कहा गया है कि GPT-3 को आज से बंद किया जा रहा है और सुझाए गए विकल्प पर सवाल उठाया गया है। पोस्ट में किसी आधिकारिक सूचना का लिंक नहीं है, इसलिए यहां इस बदलाव की स्वतंत्र रूप से पुष्टि नहीं हुई है।
लैपटॉप पर 137 अव्यवस्थित दस्तावेज़ों के साथ Qwen3-VL 8B का परीक्षण
Reddit के एक यूज़र ने रसीदों, फ़ॉर्म, इनवॉइस और कॉन्ट्रैक्ट पर स्थानीय रूप से चलने वाले एक छोटे विज़न मॉडल की तुलना तीन होस्टेड मॉडल से की। यूज़र के परीक्षण में Qwen ने टैक्स फ़ॉर्म पर अच्छा प्रदर्शन किया, लेकिन भारतीय तारीख़ फ़ॉर्मैट और लंबे कॉन्ट्रैक्ट पढ़ने में उसे दिक्कत हुई।
Reddit यूज़र ने Qwen 3.8 27B और Flash Next के बीच कोडिंग मॉडल पूछा
यूज़र ऐसा मॉडल चाहते हैं जो कोडिंग क्षमता और RTX 5090 सिस्टम पर 75–100 टोकन प्रति सेकंड की डिकोड गति के बीच संतुलन बनाए।
Qwen 3.8 27B, Pi पर llama.cpp में सब-एजेंट के रूप में काम करता है
Reddit की एक पोस्ट में दिखाया गया है कि 27 अरब पैरामीटर वाला Qwen 3.8 मॉडल, Raspberry Pi पर DeepSeek v4.1 Flash के साथ सब-एजेंट के तौर पर काम कर रहा है।
वॉइस विश्लेषण टूल्स के लिए Modulate ने जुटाए $25 मिलियन
बोस्टन का यह स्टार्टअप कॉल का विश्लेषण करने, सिंथेटिक ऑडियो का पता लगाने और वॉइस एजेंट्स पर नज़र रखने वाले टूल बेचता है। नई फंडिंग का इस्तेमाल कंपनी अपने मॉडल्स और निजता पर केंद्रित तैनाती के विकल्पों का विस्तार करने में करेगी।
Mica 4B बॉट ने Minecraft में हासिल की डायमंड पिकैक्स
एक डेवलपर का कहना है कि छोटे निर्णय लेने वाले मॉडल Mica ने Minecraft बॉट को पहली बार में खाली इन्वेंटरी से डायमंड पिकैक्स तक पहुंचाया। इस परीक्षण में बॉट ने 26 फैसले किए। बॉट ने चलने और खनन का काम संभाला, जबकि मॉडल ने कमांड चुने।
DetectifAI फोन पर डीपफेक आवाज़ की पहचान करना चाहती है
AI से बनी एक आवाज़ ने उनकी दादाजी को फिरौती देने के लिए धोखा दिया। इसके बाद संस्थापक Tarini Padmanabhuni ने DetectifAI शुरू की। कंपनी का कहना है कि उसके छोटे मॉडल फोन पर ही नकली आवाज़ें पहचान सकते हैं—ऑडियो को क्लाउड पर भेजे बिना।
ChatGPT खुद को कैसे पेश करे, इस पर रोक लगाने की मांग के साथ फ्लोरिडा अदालत पहुंचा
फ्लोरिडा के अटॉर्नी जनरल जेम्स उथमायर चाहते हैं कि न्यायाधीश OpenAI को ChatGPT को इंसान जैसा दिखाने से रोकें और नए मॉडल के लिए बाहरी मंज़ूरी वाले सुरक्षा उपाय अनिवार्य करें। यह याचिका OpenAI के खिलाफ फ्लोरिडा के मुकदमे का हिस्सा है; रिपोर्ट में अदालत के किसी फैसले का ज़िक्र नहीं है।
LlamAmpere v0.4 ने RTX 3090 पर 95+ टोकन प्रति सेकंड की रफ्तार दर्ज की
एक डेवलपर का कहना है कि Llama.cpp के इस फोर्क का नया संस्करण, एक RTX 3090 पर 262K-टोकन संदर्भ के साथ 27 अरब पैरामीटर वाला Qwen मॉडल चला सकता है। बताई गई रफ्तार 100,000 टोकन जनरेट होने तक बनी रही।
छोटे ओपन मॉडल स्थानीय ट्रेनिंग प्रोजेक्ट में तेज़ी से फैसले लेते हैं
Reddit के एक उपयोगकर्ता ने ऐसे छोटे, ओपन-वेट मॉडल जारी किए हैं, जो विकल्पों में से चुनकर टेक्स्ट बनाए बिना उनकी संभावनाएं बताते हैं। उपयोगकर्ता के मुताबिक, 0.8B मॉडल ने 28 मिलीसेकंड में फैसला किया, जबकि 2B मॉडल ने पांच बेंचमार्क की जांच में 83.1% स्कोर किया।
Reddit बेंचमार्क में Qwen3.6-35B बेस ने ज़्यादातर फाइन-ट्यून मॉडल को पछाड़ा
Reddit के एक यूज़र ने कोडिंग बेंचमार्क पर Qwen3.6-35B मॉडल और उसके पांच फाइन-ट्यून वेरिएंट की तुलना की। नतीजों में बेस मॉडल आम तौर पर बेहतर रहा और सिर्फ Occamy‑1.0 उसके करीब पहुंचा।
RTX 3090 पर Swift 1.5 ने बेंचमार्क कार्यों का समय घटाया
Reddit के एक उपयोगकर्ता के मुताबिक, संशोधित Swift 1.5 मॉडल ने एक RTX 3090 पर HyperQwen के मूल सेटअप की तुलना में बेंचमार्क कार्य करीब 37% तेज़ी से पूरे किए। गुणवत्ता की जांच में नतीजों में मामूली अंतर भी दिखा।
Anthropic ने Claude Sonnet 5.5 को उसी टोकन कीमत पर जारी किया
Anthropic का कहना है कि उसका नया मिड-टियर मॉडल 30% से अधिक तेज़ है और हर काम पर Sonnet 5 के मुकाबले 30% तक कम खर्च कर सकता है। कई परीक्षणों में इसके नतीजे अधिक महंगे Opus 5.5 के लगभग बराबर हैं।
H Company ने सॉफ्टवेयर से जुड़े कामों के लिए Holo4 मॉडल जारी किए
Holo4 केवल कंप्यूटर से बातचीत के एक ही तरीके पर निर्भर रहने के बजाय स्क्रीन, कोड और सॉफ्टवेयर टूल्स के साथ काम कर सकता है। दोनों मॉडल H Company के API के ज़रिए उपलब्ध हैं और इनके वज़न डाउनलोड भी किए जा सकते हैं।