OossaAIは急速に進化しています。私たちがわかりやすく解説します。
ニュースレター

短信 · 1 分で読める

Qwen3.6-35Bのベースモデル、Redditのベンチマークで大半のファインチューニング版を上回る

RedditユーザーがコーディングベンチマークでQwen3.6-35Bモデルと5つのファインチューニング版を比較したところ、ベースモデルが総じて優れ、Occamy-1.0だけが僅差で続いた。

Oossa · Oossaについて

2026年9月28日、RedditユーザーがAider Polyglotコーディングベンチマークを使い、Qwen3.6-35B-A3Bのベースモデルと5つのファインチューニング版を比較した結果を投稿した。ベースモデルは初回の合格率が37.4%、再試行時が71.0%で、大半のファインチューニング版を上回った。

Occamy-1.0のファインチューニング版だけが初回29.0%、再試行時70.1%と僅差で続き、Ornith-1.5、KAT-Coder、Tiel-Coder、Nex-N2.5は大きく後れを取った。ベースモデルはトークン使用量と問題を解くまでの時間も少なく、ほとんどのユーザーにとって引き続き最良の選択肢であることが示唆された。

なぜ重要か

現時点では、手を加えていないQwen3.6-35Bのほうがコミュニティ製ファインチューニング版の大半より優れたコーディング性能を発揮することが示されている。ユーザーはモデルをわざわざ切り替えずに済む。

この記事は役に立ちましたか?

出典と参考資料

#出典媒体日付要点
1Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base) ↗Reddit r/LocalLLaMA2026/09/28TL;DR -- You should probably just use base Qwen3.6-35B, as only Occamy-1.0 is competitive with it.

1 件の出典

最終更新:

Oossallms.txt.md

共有

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。