# Qwen3-VL 8B mit einem Laptop anhand von 137 unübersichtlichen Dokumenten getestet

> Ein Reddit-Nutzer verglich ein lokal ausgeführtes kleines Vision-Modell mit drei gehosteten Modellen anhand von Belegen, Formularen, Rechnungen und Verträgen. Im Test des Nutzers schnitt Qwen bei Steuerformularen gut ab, hatte aber Schwierigkeiten mit indischen Datumsformaten und langen Verträgen.

Oossa · 2026-09-28 · https://oossa.com/de/qwen3-vl-8b-tested-on-137-messy-documents-using-a-laptop

Ein Reddit-Nutzer testete Qwen3-VL 8B Instruct auf einem M5-Laptop mit 137 Dokumenten und verglich es mit Claude Opus 5.5, Sonnet 5 und GPT-5.6 Terra. Laut dem Nutzer waren 59 % der von Qwen verarbeiteten Dokumente vollständig korrekt, gegenüber 89 % bei Opus und 57 % bei GPT-5.6 Terra. Qwen erkannte 21 von 32 IRS-Formularen vollständig korrekt, GPT-5.6 Terra dagegen sieben. Bei 10 synthetischen indischen Kontoauszügen las Qwen Datumsangaben im Format Tag-Monat-Jahr jedoch als Monat-Tag-Jahr, obwohl Beträge und Kontostände richtig erkannt wurden.

## Die Fakten

- Der Test umfasste 137 Belege, Rechnungen, IRS-Formulare, Kontoauszüge und Verträge.
- Laut dem Beitrag lief Qwen auf einem M5-Laptop mit 24 GB Arbeitsspeicher und benötigte etwa 30 Sekunden pro Dokument.

## Warum es wichtig ist

Die Ergebnisse deuten darauf hin, dass ein kleines Modell auf einem Laptop manche Dokumentaufgaben gut bewältigen kann, seine Leistung je nach Format und Dokumenttyp jedoch stark schwanken kann.

## Quellen und Referenzen

1. [Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R]](https://www.reddit.com/r/MachineLearning/comments/1wsbqni/qwen3vl_8b_on_a_laptop_vs_opus_55_sonnet_5_gpt56/) – Reddit r/MachineLearning, 2026-09-28

Zuletzt aktualisiert: 2026-09-28
