# Un utilisateur de Reddit cherche un modèle de code entre Qwen 3.8 27B et Flash Next

> Il cherche un modèle qui allie de bonnes capacités en programmation à une vitesse de génération de 75 à 100 tokens par seconde sur un système équipé d’une RTX 5090.

Oossa · 2026-09-28 · https://oossa.com/fr/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

Le 28 septembre 2026, un utilisateur de Reddit a demandé sur r/LocalLLaMA quel modèle se situait entre Qwen 3.8 27B et Flash Next pour des tâches de programmation. Il a indiqué obtenir plus de 200 TPS avec Qwen 3.8 27B et environ 50 TPS avec Flash Next, sur une RTX 5090 et 96 Go de DDR5. Il cherche un compromis permettant de maintenir une vitesse de génération comprise entre 75 et 100 TPS sans sacrifier les capacités de programmation. Il prévoit de passer à 128 Go de RAM, mais veut éviter un ralentissement important.

## Les faits

- Qwen 3.8 27B : plus de 200 tokens par seconde ; Flash Next : environ 50 TPS sur une RTX 5090.
- Matériel de l’utilisateur : RTX 5090 avec 96 Go de DDR5 (passage à 128 Go prévu).

## Pourquoi c'est important

Trouver un modèle qui combine vitesse et performances en programmation aide les développeurs à avancer plus vite avec un matériel limité.

## Sources et références

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Dernière mise à jour: 2026-09-28
