संक्षिप्त · 1 मिनट पढ़ना
लैपटॉप पर 137 अव्यवस्थित दस्तावेज़ों के साथ Qwen3-VL 8B का परीक्षण
Reddit के एक यूज़र ने रसीदों, फ़ॉर्म, इनवॉइस और कॉन्ट्रैक्ट पर स्थानीय रूप से चलने वाले एक छोटे विज़न मॉडल की तुलना तीन होस्टेड मॉडल से की। यूज़र के परीक्षण में Qwen ने टैक्स फ़ॉर्म पर अच्छा प्रदर्शन किया, लेकिन भारतीय तारीख़ फ़ॉर्मैट और लंबे कॉन्ट्रैक्ट पढ़ने में उसे दिक्कत हुई।
Oossa · Oossa के बारे में
Reddit के एक यूज़र ने 137 दस्तावेज़ों का इस्तेमाल करते हुए M5 लैपटॉप पर Qwen3-VL 8B Instruct का Claude Opus 5.5, Sonnet 5 और GPT-5.6 Terra से मुकाबला किया। यूज़र के मुताबिक, Qwen के 59% नतीजों में दस्तावेज़ पूरी तरह सही थे। इसकी तुलना में Opus के लिए यह आंकड़ा 89% और GPT-5.6 Terra के लिए 57% था। Qwen ने IRS के 32 फ़ॉर्म में से 21 को पूरी तरह सही पढ़ा, जबकि GPT-5.6 Terra ने सात को। लेकिन 10 सिंथेटिक भारतीय बैंक स्टेटमेंट में Qwen ने दिन-महीना-साल वाले फ़ॉर्मैट की तारीख़ों को महीना-दिन-साल के रूप में पढ़ा, हालांकि रकम और बैलेंस सही पढ़े।
यह क्यों मायने रखता है
नतीजे बताते हैं कि लैपटॉप पर चलने वाला छोटा मॉडल दस्तावेज़ों से जुड़े कुछ काम अच्छी तरह कर सकता है, लेकिन फ़ॉर्मैट और दस्तावेज़ के प्रकार के हिसाब से उसका प्रदर्शन काफ़ी बदल सकता है।
स्रोत और संदर्भ
| # | स्रोत | प्रकाशक | तारीख | मुख्य बात |
|---|---|---|---|---|
| 1 | Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗ | Reddit r/MachineLearning | 28 सित॰ 2026 | I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C |
1 स्रोत
अंतिम अपडेट:
Oossa · न्यूज़लेटर
AI का हफ़्ता, आसान भाषा में
हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।