# Usuário do Reddit busca um modelo de programação entre Qwen 3.8 27B e Flash Next

> O usuário procura um modelo que equilibre capacidade de programação e velocidade de decodificação de 75 a 100 tokens por segundo em um sistema com RTX 5090.

Oossa · 2026-09-28 · https://oossa.com/pt/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

Em 28 de setembro de 2026, um usuário do Reddit perguntou no r/LocalLLaMA qual modelo seria adequado para tarefas de programação, entre o Qwen 3.8 27B e o Flash Next. Ele relatou velocidades acima de 200 TPS com o Qwen 3.8 27B e de cerca de 50 TPS com o Flash Next, usando uma RTX 5090 e 96 GB de DDR5. O usuário busca uma opção intermediária, com velocidade de decodificação entre 75 e 100 TPS, sem abrir mão da capacidade de programação. Ele planeja ampliar a RAM para 128 GB, mas quer evitar uma queda acentuada de desempenho.

## Os fatos

- Qwen 3.8 27B: mais de 200 tokens por segundo; Flash Next: cerca de 50 TPS com uma RTX 5090.
- Hardware do usuário: RTX 5090 com 96 GB de DDR5 (há planos de ampliar para 128 GB).

## Por que importa

Encontrar um modelo que equilibre velocidade e capacidade de programação ajuda desenvolvedores a iterar mais rapidamente com hardware limitado.

## Fontes e referências

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Última atualização: 2026-09-28
