# Qwen3.6-35B 基础模型在 Reddit 基准测试中胜过多数微调模型

> 一位 Reddit 用户在编程基准测试中比较了 Qwen3.6-35B 模型和五个微调版本，发现基础模型整体表现更好，只有 Occamy‑1.0 与其接近。

Oossa · 2026-09-28 · https://oossa.com/zh/qwen3-6-35b-base-outperforms-most-fine-tunes-in-reddit-benchmark

2026 年 9 月 28 日，一位 Reddit 用户公布了使用 Aider Polyglot 编程基准测试 Qwen3.6-35B-A3B 基础模型与五个微调版本的结果。基础模型首次尝试通过率为 37.4%，重试通过率为 71.0%，胜过大多数微调版本。

只有 Occamy‑1.0 微调版表现接近，首次尝试通过率为 29.0%，重试通过率为 70.1%；Ornith‑1.5、KAT‑Coder、Tiel‑Coder 和 Nex‑N2.5 则明显落后。基础模型的 token 用量和解题时间也更低，这表明对大多数用户来说，它仍是最佳选择。

## 事实

- 测试结果于 2026 年 9 月 28 日发布在 r/LocalLLaMA
- Qwen3.6-35B 基础模型首次尝试通过率为 37.4%，在受测模型中排名第一

## 为什么重要

这表明，至少目前，使用未经修改的 Qwen3.6-35B，编程表现优于大多数社区微调版本，用户也就不必无谓地切换模型。

## 来源与参考

1. [Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base)](https://www.reddit.com/r/LocalLLaMA/comments/1wss436/searching_for_38_35b_qwen3635ba3b_testing_5/) – Reddit r/LocalLLaMA, 2026-09-28

最后更新: 2026-09-28
