OossaL'IA évolue vite. Nous l'expliquons simplement.
Newsletter

Brève · 1 min de lecture

Qwen3-VL 8B testé sur 137 documents complexes depuis un ordinateur portable

Un utilisateur de Reddit a comparé un petit modèle de vision exécuté en local à trois modèles hébergés, sur des reçus, des formulaires, des factures et des contrats. Lors de son test, Qwen s’en est bien sorti avec les formulaires fiscaux, mais a eu du mal avec les formats de date indiens et les longs contrats.

Oossa · À propos d’Oossa

Un utilisateur de Reddit a testé Qwen3-VL 8B Instruct sur un ordinateur portable M5, en le comparant à Claude Opus 5.5, Sonnet 5 et GPT-5.6 Terra, à partir de 137 documents. Selon l’utilisateur, les résultats de Qwen étaient entièrement corrects pour 59 % des documents, contre 89 % pour Opus et 57 % pour GPT-5.6 Terra. Qwen a correctement traité 21 des 32 formulaires de l’IRS, contre sept pour GPT-5.6 Terra. En revanche, sur 10 relevés bancaires indiens synthétiques, Qwen a interprété les dates au format jour-mois-année comme si elles étaient au format mois-jour-année, tout en lisant correctement les montants et les soldes.

Pourquoi c'est important

Ces résultats suggèrent qu’un petit modèle exécuté sur un ordinateur portable peut bien s’acquitter de certaines tâches liées aux documents, mais que ses performances peuvent varier fortement selon les formats et les types de documents.

Cet article vous a-t-il été utile ?

Sources et références

#SourceMédiaDateÀ retenir
1Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗Reddit r/MachineLearning28 sept. 2026I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C

1 sources

Dernière mise à jour:

Oossallms.txt.md

Partager

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.