Kısa haber · 1 dk okuma
Qwen3-VL 8B, dizüstü bilgisayarda 137 karmaşık belgeyle test edildi
Bir Reddit kullanıcısı, yerel olarak çalışan küçük bir görsel modeli; makbuzlar, formlar, faturalar ve sözleşmeler üzerinde üç çevrimiçi modelle karşılaştırdı. Kullanıcının testinde Qwen vergi formlarında başarılı olurken Hindistan’daki tarih biçimlerinde ve uzun sözleşmelerde zorlandı.
Oossa · Oossa Hakkında
Bir Reddit kullanıcısı, 137 belge kullanarak Qwen3-VL 8B Instruct’ı M5 dizüstü bilgisayarda Claude Opus 5.5, Sonnet 5 ve GPT-5.6 Terra ile karşılaştırdı. Kullanıcı, Qwen’in sonuçlarının yüzde 59’unda belgelerin tamamen doğru olduğunu; bu oranın Opus’ta yüzde 89, GPT-5.6 Terra’da ise yüzde 57 olduğunu bildirdi. Qwen, 32 IRS formunun 21’ini tamamen doğru okurken GPT-5.6 Terra yalnızca yedisini doğru okudu. Ancak 10 sentetik Hindistan banka ekstresinde Qwen, tutarları ve bakiyeleri doğru okumasına rağmen gün-ay-yıl biçimindeki tarihleri ay-gün-yıl olarak yorumladı.
Neden önemli
Sonuçlar, dizüstü bilgisayarda çalışan küçük bir modelin bazı belge işleme görevlerini başarıyla yerine getirebildiğini, ancak performansın biçimlere ve belge türlerine göre ciddi ölçüde değişebildiğini gösteriyor.
Kaynaklar ve referanslar
| # | Kaynak | Yayın | Tarih | Ana fikir |
|---|---|---|---|---|
| 1 | Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗ | Reddit r/MachineLearning | 28 Eyl 2026 | I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C |
1 kaynak
Son güncelleme:
Oossa · Bülten
Yapay zekâda hafta, anlaşılır dille
Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.