# Tencent ने जारी किया 5B पैरामीटर वाला Youtu-Parsing-Omni मॉडल

> Hugging Face पर उपलब्ध यह नया मॉडल दस्तावेज़, तस्वीरें, चार्ट, ऑडियो और वीडियो पढ़कर एक ही JSON संरचना में जानकारी देता है।

Oossa · 2026-10-09 · https://oossa.com/hi/tencent-releases-youtu-parsing-omni-a-5b-omni-modal-parsing-model

Tencent ने Youtu-Parsing-Omni को Hugging Face पर अपलोड किया है। यह 5 बिलियन पैरामीटर वाला कॉम्पैक्ट मॉडल है, जो एक ही इनपुट—जैसे टेक्स्ट का पन्ना, तस्वीर, चार्ट, ऑडियो क्लिप या वीडियो—लेकर लेआउट, टेक्स्ट, टेबल, फ़ॉर्मूले, टाइमस्टैम्प और कैप्शन का ब्यौरा देने वाला संरचित JSON आउटपुट देता है। खुले मॉडलों में इसने OmniDocBench बेंचमार्क पर सबसे अधिक Overall स्कोर हासिल किया और OmniParsingBench पर Gemini‑3‑Pro के बाद दूसरे स्थान पर रहा। इसे आसानी से सर्व करने के लिए vLLM प्लगइन और इन्फ़रेंस के उदाहरण भी शामिल हैं।

## तथ्य

- 5 B पैरामीटर
- अक्टूबर 2026 में Hugging Face पर जारी

## यह क्यों मायने रखता है

डेवलपर अलग-अलग OCR, ऑडियो या वीडियो मॉडल की ज़रूरत के बिना ऐप्स में कई तरह के दस्तावेज़ समझने की क्षमता जोड़ सकते हैं।

## स्रोत और संदर्भ

1. [New model on Hugging Face: tencent/Youtu-Parsing-Omni (image-text-to-text)](https://huggingface.co/tencent/Youtu-Parsing-Omni) – Tencent Hunyuan, 2026-10-09

अंतिम अपडेट: 2026-10-09
