# Un utente di Reddit cerca un modello di coding a metà strada tra Qwen 3.8 27B e Flash Next

> L’utente vuole un modello che bilanci le capacità di coding con una velocità di generazione di 75-100 token al secondo su un sistema con RTX 5090.

Oossa · 2026-09-28 · https://oossa.com/it/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

Il 28 settembre 2026, un utente di Reddit ha chiesto su r/LocalLLaMA quale modello si collochi tra Qwen 3.8 27B e Flash Next per le attività di coding. Ha riferito di ottenere oltre 200 TPS con Qwen 3.8 27B e circa 50 TPS con Flash Next, usando una RTX 5090 e 96 GB di DDR5. Cerca una via di mezzo che mantenga la velocità di generazione tra 75 e 100 TPS senza sacrificare le capacità di coding. L’utente prevede di portare la RAM a 128 GB, ma vuole evitare un forte rallentamento.

## I fatti

- Qwen 3.8 27B: oltre 200 token al secondo; Flash Next: circa 50 TPS con una RTX 5090.
- Hardware dell’utente: RTX 5090 con 96 GB di DDR5 (è previsto un upgrade a 128 GB).

## Perché conta

Trovare un modello che bilanci velocità e capacità di coding aiuta gli sviluppatori a lavorare più rapidamente anche con hardware limitato.

## Fonti e riferimenti

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Ultimo aggiornamento: 2026-09-28
