OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.
Bülten

Kısa haber · 1 dk okuma

Qwen3-VL 8B, dizüstü bilgisayarda 137 karmaşık belgeyle test edildi

Bir Reddit kullanıcısı, yerel olarak çalışan küçük bir görsel modeli; makbuzlar, formlar, faturalar ve sözleşmeler üzerinde üç çevrimiçi modelle karşılaştırdı. Kullanıcının testinde Qwen vergi formlarında başarılı olurken Hindistan’daki tarih biçimlerinde ve uzun sözleşmelerde zorlandı.

Oossa · Oossa Hakkında

Bir Reddit kullanıcısı, 137 belge kullanarak Qwen3-VL 8B Instruct’ı M5 dizüstü bilgisayarda Claude Opus 5.5, Sonnet 5 ve GPT-5.6 Terra ile karşılaştırdı. Kullanıcı, Qwen’in sonuçlarının yüzde 59’unda belgelerin tamamen doğru olduğunu; bu oranın Opus’ta yüzde 89, GPT-5.6 Terra’da ise yüzde 57 olduğunu bildirdi. Qwen, 32 IRS formunun 21’ini tamamen doğru okurken GPT-5.6 Terra yalnızca yedisini doğru okudu. Ancak 10 sentetik Hindistan banka ekstresinde Qwen, tutarları ve bakiyeleri doğru okumasına rağmen gün-ay-yıl biçimindeki tarihleri ay-gün-yıl olarak yorumladı.

Neden önemli

Sonuçlar, dizüstü bilgisayarda çalışan küçük bir modelin bazı belge işleme görevlerini başarıyla yerine getirebildiğini, ancak performansın biçimlere ve belge türlerine göre ciddi ölçüde değişebildiğini gösteriyor.

Bu makale faydalı oldu mu?

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗Reddit r/MachineLearning28 Eyl 2026I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C

1 kaynak

Son güncelleme:

Oossallms.txt.md

Paylaş

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.