OossaL'IA évolue vite. Nous l'expliquons simplement.
Newsletter

Brève · 1 min de lecture

Qwen3.6-35B de base surpasse la plupart des versions affinées dans un benchmark Reddit

Un utilisateur de Reddit a comparé le modèle Qwen3.6-35B à cinq variantes affinées sur un benchmark de programmation. Résultat : le modèle de base s’est généralement montré supérieur, et seul Occamy-1.0 lui a tenu tête.

Oossa · À propos d’Oossa

Le 28 septembre 2026, un utilisateur de Reddit a publié les résultats d’une comparaison entre le modèle de base Qwen3.6-35B-A3B et cinq variantes affinées, à l’aide du benchmark de programmation Aider Polyglot. Le modèle de base a obtenu un taux de réussite de 37,4 % au premier essai et de 71,0 % après une nouvelle tentative, dépassant la plupart des versions affinées.

Seul le modèle affiné Occamy-1.0 s’en est approché, avec 29,0 % de réussite au premier essai et 70,1 % après une nouvelle tentative, tandis qu’Ornith-1.5, KAT-Coder, Tiel-Coder et Nex-N2.5 étaient nettement à la traîne. Le modèle de base a également consommé moins de tokens et nécessité moins de temps pour résoudre les problèmes, ce qui laisse penser qu’il reste le meilleur choix pour la plupart des utilisateurs.

Pourquoi c'est important

Ces résultats montrent que, pour l’instant, le modèle Qwen3.6-35B sans modification offre de meilleures performances en programmation que la plupart des versions affinées par la communauté, évitant ainsi aux utilisateurs de changer de modèle inutilement.

Cet article vous a-t-il été utile ?

Sources et références

#SourceMédiaDateÀ retenir
1Searching for 3.8 35B: Qwen3.6-35B-A3B (Testing 5 Finetunes vs. Base) ↗Reddit r/LocalLLaMA28 sept. 2026TL;DR -- You should probably just use base Qwen3.6-35B, as only Occamy-1.0 is competitive with it.

1 sources

Dernière mise à jour:

Oossallms.txt.md

Partager

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.

Qwen3.6-35B de base surpasse la plupart des versions affinées dans un benchmark Reddit – Oossa