# Un usuario de Reddit busca un modelo de programación entre Qwen 3.8 27B y Flash Next

> El usuario quiere un modelo que combine capacidad para programar con una velocidad de generación de 75-100 tokens por segundo en un sistema con RTX 5090.

Oossa · 2026-09-28 · https://oossa.com/es/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

El 28 de septiembre de 2026, un usuario de Reddit preguntó en r/LocalLLaMA qué modelo se sitúa entre Qwen 3.8 27B y Flash Next para tareas de programación. Según contó, alcanza más de 200 TPS con Qwen 3.8 27B y unos 50 TPS con Flash Next en un equipo con RTX 5090 y 96 GB de DDR5. Busca un término medio que mantenga la velocidad de generación entre 75 y 100 TPS sin renunciar a la capacidad para programar. El usuario tiene previsto ampliar la RAM a 128 GB, pero quiere evitar una ralentización importante.

## Los hechos

- Qwen 3.8 27B: más de 200 tokens por segundo; Flash Next: unos 50 TPS con una RTX 5090.
- Equipo del usuario: RTX 5090 con 96 GB de DDR5 (prevé ampliarla a 128 GB).

## Por qué importa

Encontrar un modelo que equilibre velocidad y capacidad para programar permite a los desarrolladores iterar más rápido con hardware limitado.

## Fuentes y referencias

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Última actualización: 2026-09-28
