OossaKI entwickelt sich schnell. Wir erklären es einfach.
Newsletter

Kurzmeldung · 1 Min. Lesezeit

Reddit-Nutzer sucht ein Coding-Modell zwischen Qwen 3.8 27B und Flash Next

Gesucht wird ein Modell, das gute Coding-Fähigkeiten mit einer Decodiergeschwindigkeit von 75 bis 100 Tokens pro Sekunde auf einem System mit RTX 5090 verbindet.

Oossa · Über Oossa

Am 28. September 2026 fragte ein Reddit-Nutzer im Subreddit r/LocalLLaMA, welches Modell sich für Coding-Aufgaben zwischen Qwen 3.8 27B und Flash Next einordnet. Mit Qwen 3.8 27B erreiche das System mit RTX 5090 und 96 GB DDR5 mehr als 200 TPS, mit Flash Next rund 50 TPS. Gesucht wird ein Mittelweg mit einer Decodiergeschwindigkeit von 75 bis 100 TPS, ohne Abstriche bei den Coding-Fähigkeiten. Der Nutzer plant, den Arbeitsspeicher auf 128 GB aufzurüsten, möchte dabei aber einen deutlichen Geschwindigkeitseinbruch vermeiden.

Warum es wichtig ist

Ein Modell mit ausgewogener Geschwindigkeit und guten Coding-Fähigkeiten hilft Entwicklern, auch auf begrenzter Hardware schneller zu arbeiten.

War dieser Artikel hilfreich?

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1What model sits between Qwen 3.8 27b and Flash next for coding? ↗Reddit r/LocalLLaMA28.09.2026Having tested both Qwen 3.8 27b and Flash next on RTX 5090 with 96GB RAM, I want to find the middle ground between the two for coding capabi

1 Quellen

Zuletzt aktualisiert:

Oossallms.txt.md

Teilen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.