# Reddit 用户征求介于 Qwen 3.8 27B 和 Flash Next 之间的编程模型

> 这位用户希望找到一款兼顾编程能力、并能在 RTX 5090 系统上达到每秒 75 至 100 个 token 解码速度的模型。

Oossa · 2026-09-28 · https://oossa.com/zh/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

2026 年 9 月 28 日，一名 Reddit 用户在 r/LocalLLaMA 发帖询问，哪款模型适合用于编程任务，性能介于 Qwen 3.8 27B 和 Flash Next 之间。用户表示，在配备 RTX 5090 和 96 GB DDR5 内存的系统上，Qwen 3.8 27B 的速度超过每秒 200 个 token，而 Flash Next 的速度约为每秒 50 个 token。他们希望找到一个折中方案，在不牺牲编程能力的前提下，将解码速度维持在每秒 75 至 100 个 token。用户计划将内存升级至 128 GB，但不希望速度大幅下降。

## 事实

- 在 RTX 5090 上，Qwen 3.8 27B 的速度超过每秒 200 个 token；Flash Next 约为每秒 50 个 token。
- 用户的硬件配置：RTX 5090 和 96 GB DDR5 内存（计划升级至 128 GB）。

## 为什么重要

找到一款兼具速度和编程能力的模型，有助于开发者在硬件有限的情况下更快地迭代。

## 来源与参考

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

最后更新: 2026-09-28
