# Reddit-Nutzer sucht ein Coding-Modell zwischen Qwen 3.8 27B und Flash Next

> Gesucht wird ein Modell, das gute Coding-Fähigkeiten mit einer Decodiergeschwindigkeit von 75 bis 100 Tokens pro Sekunde auf einem System mit RTX 5090 verbindet.

Oossa · 2026-09-28 · https://oossa.com/de/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

Am 28. September 2026 fragte ein Reddit-Nutzer im Subreddit r/LocalLLaMA, welches Modell sich für Coding-Aufgaben zwischen Qwen 3.8 27B und Flash Next einordnet. Mit Qwen 3.8 27B erreiche das System mit RTX 5090 und 96 GB DDR5 mehr als 200 TPS, mit Flash Next rund 50 TPS. Gesucht wird ein Mittelweg mit einer Decodiergeschwindigkeit von 75 bis 100 TPS, ohne Abstriche bei den Coding-Fähigkeiten. Der Nutzer plant, den Arbeitsspeicher auf 128 GB aufzurüsten, möchte dabei aber einen deutlichen Geschwindigkeitseinbruch vermeiden.

## Die Fakten

- Qwen 3.8 27B: mehr als 200 Tokens pro Sekunde; Flash Next: rund 50 TPS auf einer RTX 5090.
- Hardware des Nutzers: RTX 5090 mit 96 GB DDR5 (Aufrüstung auf 128 GB geplant).

## Warum es wichtig ist

Ein Modell mit ausgewogener Geschwindigkeit und guten Coding-Fähigkeiten hilft Entwicklern, auch auf begrenzter Hardware schneller zu arbeiten.

## Quellen und Referenzen

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

Zuletzt aktualisiert: 2026-09-28
