# Qwen3.6-35Bのベースモデル、Redditのベンチマークで大半のファインチューニング版を上回る

> RedditユーザーがコーディングベンチマークでQwen3.6-35Bモデルと5つのファインチューニング版を比較したところ、ベースモデルが総じて優れ、Occamy-1.0だけが僅差で続いた。

Oossa · 2026-09-28 · https://oossa.com/ja/qwen3-6-35b-base-outperforms-most-fine-tunes-in-reddit-benchmark

2026年9月28日、RedditユーザーがAider Polyglotコーディングベンチマークを使い、Qwen3.6-35B-A3Bのベースモデルと5つのファインチューニング版を比較した結果を投稿した。ベースモデルは初回の合格率が37.4％、再試行時が71.0％で、大半のファインチューニング版を上回った。

Occamy-1.0のファインチューニング版だけが初回29.0％、再試行時70.1％と僅差で続き、Ornith-1.5、KAT-Coder、Tiel-Coder、Nex-N2.5は大きく後れを取った。ベースモデルはトークン使用量と問題を解くまでの時間も少なく、ほとんどのユーザーにとって引き続き最良の選択肢であることが示唆された。

## 事実

- テスト結果は2026年9月28日にr/LocalLLaMAで投稿された
- Qwen3.6-35Bのベースモデルは初回合格率37.4％で、テスト対象の中で最も高かった

## なぜ重要か

現時点では、手を加えていないQwen3.6-35Bのほうがコミュニティ製ファインチューニング版の大半より優れたコーディング性能を発揮することが示されている。ユーザーはモデルをわざわざ切り替えずに済む。

## 出典と参考資料

1. [Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base)](https://www.reddit.com/r/LocalLLaMA/comments/1wss436/searching_for_38_35b_qwen3635ba3b_testing_5/) – Reddit r/LocalLLaMA, 2026-09-28

最終更新: 2026-09-28
