Oossaالذكاء الاصطناعي يتطور بسرعة. نحن نشرحه ببساطة.
النشرة البريدية

خبر موجز · 1 دقائق قراءة

اختبار Qwen3-VL 8B على 137 مستندًا فوضويًا باستخدام حاسوب محمول

قارن مستخدم على Reddit بين نموذج رؤية صغير يعمل محليًا وثلاثة نماذج مستضافة، مستخدمًا إيصالات ونماذج وفواتير وعقودًا. وفي اختبار المستخدم، حقق Qwen نتائج جيدة في النماذج الضريبية، لكنه واجه صعوبة في قراءة تنسيقات التاريخ الهندية والعقود الطويلة.

Oossa · عن Oossa

اختبر مستخدم على Reddit نموذج Qwen3-VL 8B Instruct على حاسوب محمول مزود بمعالج M5، وقارنه بـ Claude Opus 5.5 وSonnet 5 وGPT-5.6 Terra، باستخدام 137 مستندًا. وأفاد المستخدم بأن Qwen قدّم نتائج صحيحة بالكامل في 59% من الحالات، مقارنةً بـ89% لـOpus و57% لـGPT-5.6 Terra. وتمكّن Qwen من قراءة 21 نموذجًا من أصل 32 نموذجًا تابعًا لدائرة الإيرادات الداخلية الأمريكية (IRS) قراءة صحيحة بالكامل، بينما حقق GPT-5.6 Terra ذلك في سبعة نماذج. لكن عند اختبار Qwen على 10 كشوف حسابات مصرفية هندية اصطناعية، قرأ التواريخ المكتوبة بصيغة اليوم-الشهر-السنة على أنها الشهر-اليوم-السنة، رغم قراءته المبالغ والأرصدة قراءة صحيحة.

لماذا يهم

تشير النتائج إلى أن نموذجًا صغيرًا يعمل على حاسوب محمول يمكنه إنجاز بعض مهام معالجة المستندات جيدًا، لكن أداءه قد يتفاوت كثيرًا بحسب التنسيقات وأنواع المستندات.

هل كان هذا المقال مفيدًا؟

المصادر والمراجع

#المصدرالجهة الناشرةالتاريخالخلاصة
1Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗Reddit r/MachineLearning28‏/09‏/2026I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C

1 مصادر

آخر تحديث:

Oossallms.txt.md

مشاركة

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.

اختبار Qwen3-VL 8B على 137 مستندًا فوضويًا باستخدام حاسوب محمول – Oossa