# 레딧 이용자, Qwen 3.8 27B와 Flash Next 사이의 코딩 모델 추천 요청

> 이용자는 RTX 5090 시스템에서 초당 75~100토큰의 디코딩 속도와 코딩 성능을 모두 갖춘 모델을 찾고 있다.

Oossa · 2026-09-28 · https://oossa.com/ko/reddit-user-asks-for-a-coding-model-between-qwen-3-8-27b-and-flash-next

2026년 9월 28일, 한 레딧 이용자가 r/LocalLLaMA에 코딩 작업에 쓸 Qwen 3.8 27B와 Flash Next 사이 수준의 모델이 무엇인지 물었다. 이용자는 RTX 5090과 96GB DDR5 메모리를 갖춘 시스템에서 Qwen 3.8 27B는 초당 200토큰 이상, Flash Next는 초당 약 50토큰의 속도를 냈다고 밝혔다. 코딩 성능은 유지하면서 디코딩 속도는 초당 75~100토큰인 중간 지점을 원한다. 메모리를 128GB로 업그레이드할 계획이지만, 속도가 크게 느려지는 것은 피하고 싶다고 했다.

## 팩트

- Qwen 3.8 27B: RTX 5090에서 초당 200토큰 이상; Flash Next: 초당 약 50토큰.
- 이용자의 하드웨어: RTX 5090 및 96GB DDR5 메모리(128GB로 업그레이드 예정).

## 왜 중요한가

속도와 코딩 성능의 균형이 맞는 모델을 찾으면 제한된 하드웨어에서도 개발자가 더 빠르게 작업을 반복할 수 있다.

## 출처 및 참고 자료

1. [What model sits between Qwen 3.8 27b and Flash next for coding?](https://www.reddit.com/r/LocalLLaMA/comments/1wsekkj/what_model_sits_between_qwen_38_27b_and_flash/) – Reddit r/LocalLLaMA, 2026-09-28

최종 업데이트: 2026-09-28
