Brève · 1 min de lecture
Qwen3-VL 8B testé sur 137 documents complexes depuis un ordinateur portable
Un utilisateur de Reddit a comparé un petit modèle de vision exécuté en local à trois modèles hébergés, sur des reçus, des formulaires, des factures et des contrats. Lors de son test, Qwen s’en est bien sorti avec les formulaires fiscaux, mais a eu du mal avec les formats de date indiens et les longs contrats.
Oossa · À propos d’Oossa
Un utilisateur de Reddit a testé Qwen3-VL 8B Instruct sur un ordinateur portable M5, en le comparant à Claude Opus 5.5, Sonnet 5 et GPT-5.6 Terra, à partir de 137 documents. Selon l’utilisateur, les résultats de Qwen étaient entièrement corrects pour 59 % des documents, contre 89 % pour Opus et 57 % pour GPT-5.6 Terra. Qwen a correctement traité 21 des 32 formulaires de l’IRS, contre sept pour GPT-5.6 Terra. En revanche, sur 10 relevés bancaires indiens synthétiques, Qwen a interprété les dates au format jour-mois-année comme si elles étaient au format mois-jour-année, tout en lisant correctement les montants et les soldes.
Pourquoi c'est important
Ces résultats suggèrent qu’un petit modèle exécuté sur un ordinateur portable peut bien s’acquitter de certaines tâches liées aux documents, mais que ses performances peuvent varier fortement selon les formats et les types de documents.
Sources et références
| # | Source | Média | Date | À retenir |
|---|---|---|---|---|
| 1 | Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗ | Reddit r/MachineLearning | 28 sept. 2026 | I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C |
1 sources
Dernière mise à jour:
Oossa · Newsletter
La semaine de l'IA, expliquée
Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.