짧은 소식 · 1 분 읽기
Reddit 벤치마크에서 대부분의 파인튜닝 모델 앞선 Qwen3.6-35B 기본 모델
Reddit 사용자가 코딩 벤치마크에서 Qwen3.6-35B 모델과 파인튜닝 변형 5종을 비교한 결과, 기본 모델이 대체로 더 뛰어났고 Occamy-1.0만 근접한 성능을 보였다.
Oossa · Oossa 소개
2026년 9월 28일, 한 Reddit 사용자가 Aider Polyglot 코딩 벤치마크를 이용해 Qwen3.6-35B-A3B 기본 모델과 파인튜닝 변형 5종의 결과를 공개했다. 기본 모델은 첫 시도 통과율 37.4%, 재시도 통과율 71.0%를 기록해 대부분의 파인튜닝 모델을 앞섰다.
Occamy-1.0 파인튜닝 모델만 첫 시도 통과율 29.0%, 재시도 통과율 70.1%로 기본 모델에 근접했다. Ornith-1.5, KAT-Coder, Tiel-Coder, Nex-N2.5는 크게 뒤처졌다. 기본 모델은 토큰 사용량과 문제 해결 시간도 더 적어, 대부분의 사용자에게 여전히 최선의 선택임을 시사한다.
왜 중요한가
이번 결과는 당분간 수정하지 않은 Qwen3.6-35B를 사용하는 편이 대부분의 커뮤니티 파인튜닝 모델보다 코딩 성능이 뛰어나며, 불필요하게 모델을 바꿔 쓸 필요가 없음을 보여준다.
이 기사가 도움이 되었나요?
출처 및 참고 자료
| # | 출처 | 매체 | 날짜 | 핵심 내용 |
|---|---|---|---|---|
| 1 | Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base) ↗ | Reddit r/LocalLLaMA | 2026. 9. 28. | TL;DR -- You should probably just use base Qwen3.6-35B, as only Occamy-1.0 is competitive with it. |
1 개 출처
최종 업데이트:
Oossa · 뉴스레터
이번 주 AI, 쉽게 정리
매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.