# Пользователь Reddit ищет модель для программирования между Qwen 3.8 27B и Flash Next

> Пользователю нужна модель, сочетающая хорошие возможности для программирования со скоростью генерации 75–100 токенов в секунду на системе с RTX 5090.

Oossa · 2026-09-28 · https://oossa.com/ru/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

28 сентября 2026 года пользователь Reddit спросил в r/LocalLLaMA, какая модель подойдёт для программирования и займёт промежуточное место между Qwen 3.8 27B и Flash Next. По его словам, Qwen 3.8 27B выдаёт более 200 токенов в секунду, а Flash Next — около 50 на системе с RTX 5090 и 96 ГБ DDR5. Пользователь ищет компромисс: скорость генерации 75–100 токенов в секунду без потери возможностей для программирования. Он планирует увеличить объём оперативной памяти до 128 ГБ, но не хочет, чтобы система заметно замедлилась.

## Факты

- Qwen 3.8 27B: более 200 токенов в секунду; Flash Next: около 50 токенов в секунду на RTX 5090.
- Конфигурация пользователя: RTX 5090 и 96 ГБ DDR5; планируется увеличить объём памяти до 128 ГБ.

## Почему это важно

Модель, сочетающая скорость и хорошие возможности для программирования, поможет разработчикам быстрее выполнять итерации на ограниченном оборудовании.

## Источники и ссылки

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Обновлено: 2026-09-28
