OossaL'IA évolue vite. Nous l'expliquons simplement.
Newsletter

Brève · 1 min de lecture

L’ajustement par soft prompt aide les benchmarks à évaluer les connaissances plutôt que le format

Aleph Alpha montre qu’entraîner seulement dix minuscules vecteurs pendant une minute suffit à faire répondre les modèles de base dans le bon format et à obtenir des scores plus clairs.

Oossa · À propos d’Oossa

Aleph Alpha a publié une méthode qui ajuste seulement quelques vecteurs apprenables — appelés soft prompts — afin d’enseigner à un modèle de langage figé le format exact attendu par un benchmark. L’ajustement nécessite environ 80 étapes, soit quelque 1,5 minute pour un modèle de 7 milliards de paramètres, et porte la précision du respect du format à près de 100 %, sans modifier les connaissances du modèle.

Comme le score de connaissances du modèle reste stable tandis que sa maîtrise du format s’améliore, les chercheurs peuvent comparer équitablement les modèles de base et prévoir leur classement après un post-entraînement complet, économisant ainsi des semaines de calcul.

Pourquoi c'est important

Cette méthode permet aux développeurs d’évaluer et de classer rapidement les modèles sans recourir à un entraînement complet coûteux, en se concentrant sur ce que le modèle sait réellement.

Cet article vous a-t-il été utile ?

Sources et références

#SourceMédiaDateÀ retenir
1Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation ↗Aleph Alpha29 sept. 2026

1 sources

Dernière mise à jour:

Oossallms.txt.md

Partager

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.