短信 · 1 分で読める
Qwen3.6-35Bのベースモデル、Redditのベンチマークで大半のファインチューニング版を上回る
RedditユーザーがコーディングベンチマークでQwen3.6-35Bモデルと5つのファインチューニング版を比較したところ、ベースモデルが総じて優れ、Occamy-1.0だけが僅差で続いた。
Oossa · Oossaについて
2026年9月28日、RedditユーザーがAider Polyglotコーディングベンチマークを使い、Qwen3.6-35B-A3Bのベースモデルと5つのファインチューニング版を比較した結果を投稿した。ベースモデルは初回の合格率が37.4%、再試行時が71.0%で、大半のファインチューニング版を上回った。
Occamy-1.0のファインチューニング版だけが初回29.0%、再試行時70.1%と僅差で続き、Ornith-1.5、KAT-Coder、Tiel-Coder、Nex-N2.5は大きく後れを取った。ベースモデルはトークン使用量と問題を解くまでの時間も少なく、ほとんどのユーザーにとって引き続き最良の選択肢であることが示唆された。
なぜ重要か
現時点では、手を加えていないQwen3.6-35Bのほうがコミュニティ製ファインチューニング版の大半より優れたコーディング性能を発揮することが示されている。ユーザーはモデルをわざわざ切り替えずに済む。
この記事は役に立ちましたか?
出典と参考資料
| # | 出典 | 媒体 | 日付 | 要点 |
|---|---|---|---|---|
| 1 | Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base) ↗ | Reddit r/LocalLLaMA | 2026/09/28 | TL;DR -- You should probably just use base Qwen3.6-35B, as only Occamy-1.0 is competitive with it. |
1 件の出典
最終更新:
Oossa · ニュースレター
今週のAIを、わかりやすく
毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。