Заметка · 1 мин чтения
Пользователь Reddit ищет модель для программирования между Qwen 3.8 27B и Flash Next
Пользователю нужна модель, сочетающая хорошие возможности для программирования со скоростью генерации 75–100 токенов в секунду на системе с RTX 5090.
Oossa · О проекте Oossa
28 сентября 2026 года пользователь Reddit спросил в r/LocalLLaMA, какая модель подойдёт для программирования и займёт промежуточное место между Qwen 3.8 27B и Flash Next. По его словам, Qwen 3.8 27B выдаёт более 200 токенов в секунду, а Flash Next — около 50 на системе с RTX 5090 и 96 ГБ DDR5. Пользователь ищет компромисс: скорость генерации 75–100 токенов в секунду без потери возможностей для программирования. Он планирует увеличить объём оперативной памяти до 128 ГБ, но не хочет, чтобы система заметно замедлилась.
Почему это важно
Модель, сочетающая скорость и хорошие возможности для программирования, поможет разработчикам быстрее выполнять итерации на ограниченном оборудовании.
Источники и ссылки
| # | Источник | Издание | Дата | Главное |
|---|---|---|---|---|
| 1 | What model sits between Qwen 3.8 27b and Flash next for coding? ↗ | Reddit r/LocalLLaMA | 28 сент. 2026 г. | Having tested both Qwen 3.8 27b and Flash next on RTX 5090 with 96GB RAM, I want to find the middle ground between the two for coding capabi |
1 источников
Обновлено:
Oossa · Рассылка
Неделя ИИ — простыми словами
Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.