Заметка · 1 мин чтения
Qwen3-VL 8B испытали на 137 неидеальных документах — на ноутбуке
Пользователь Reddit сравнил небольшую локальную модель для работы с изображениями с тремя облачными моделями на чеках, бланках, счетах и договорах. По результатам теста, Qwen хорошо справилась с налоговыми формами, но ошибалась в индийском формате дат и испытывала трудности с длинными договорами.
Oossa · О проекте Oossa
Пользователь Reddit испытал Qwen3-VL 8B Instruct на ноутбуке с M5, сравнив её с Claude Opus 5.5, Sonnet 5 и GPT-5.6 Terra на 137 документах. По его словам, Qwen полностью корректно обработала 59% документов — против 89% у Opus и 57% у GPT-5.6 Terra. Qwen без ошибок распознала 21 из 32 форм IRS, тогда как GPT-5.6 Terra справилась с семью. Однако в 10 синтетических выписках индийских банков Qwen прочитала даты в формате «день-месяц-год» как «месяц-день-год», хотя правильно распознала суммы и остатки.
Почему это важно
Результаты показывают, что небольшая модель на ноутбуке может хорошо справляться с некоторыми задачами по обработке документов, но её эффективность сильно зависит от формата и типа документа.
Источники и ссылки
| # | Источник | Издание | Дата | Главное |
|---|---|---|---|---|
| 1 | Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R] ↗ | Reddit r/MachineLearning | 28 сент. 2026 г. | I benchmarked Qwen3-VL 8B Instruct (Q4_K_M, Ollama, M5 24GB, ~30s/doc) against Claude Opus 5.5, Sonnet 5 and GPT-5.6 Terra on: - receipts: C |
1 источников
Обновлено:
Oossa · Рассылка
Неделя ИИ — простыми словами
Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.