OossaAI 发展迅速。我们用简单的话讲清楚。
新闻简报

简讯 · 1 分钟阅读

Qwen3.6-35B 基础模型在 Reddit 基准测试中胜过多数微调模型

一位 Reddit 用户在编程基准测试中比较了 Qwen3.6-35B 模型和五个微调版本,发现基础模型整体表现更好,只有 Occamy‑1.0 与其接近。

Oossa · 关于 Oossa

2026 年 9 月 28 日,一位 Reddit 用户公布了使用 Aider Polyglot 编程基准测试 Qwen3.6-35B-A3B 基础模型与五个微调版本的结果。基础模型首次尝试通过率为 37.4%,重试通过率为 71.0%,胜过大多数微调版本。

只有 Occamy‑1.0 微调版表现接近,首次尝试通过率为 29.0%,重试通过率为 70.1%;Ornith‑1.5、KAT‑Coder、Tiel‑Coder 和 Nex‑N2.5 则明显落后。基础模型的 token 用量和解题时间也更低,这表明对大多数用户来说,它仍是最佳选择。

为什么重要

这表明,至少目前,使用未经修改的 Qwen3.6-35B,编程表现优于大多数社区微调版本,用户也就不必无谓地切换模型。

这篇文章有帮助吗?

来源与参考

#来源发布方日期要点
1Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base) ↗Reddit r/LocalLLaMA2026年9月28日TL;DR -- You should probably just use base Qwen3.6-35B, as only Occamy-1.0 is competitive with it.

1 个来源

最后更新:

Oossallms.txt.md

分享

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。