# Il tuning dei soft prompt aiuta i benchmark per gli LLM a valutare le conoscenze, non il formato

> Aleph Alpha dimostra che bastano dieci minuscoli vettori, addestrati per un minuto, per far sì che i modelli di base rispondano nel formato corretto e ottenere valutazioni più chiare.

Oossa · 2026-09-29 · https://oossa.com/it/soft-prompt-tuning-helps-llm-benchmarks-focus-on-knowledge-not-format

Aleph Alpha ha presentato un metodo che modifica solo pochi vettori addestrabili, chiamati soft prompt, per insegnare a un modello linguistico congelato il formato esatto richiesto da un benchmark. Il tuning richiede circa 80 passaggi, ossia all’incirca 1,5 minuti per un modello da 7 miliardi di parametri, e porta l’accuratezza nel rispetto del formato vicino al 100 per cento, senza modificare le conoscenze del modello.

Poiché il punteggio relativo alle conoscenze resta invariato mentre migliora il rispetto del formato, i ricercatori possono confrontare equamente i modelli di base e prevedere come si classificheranno dopo un post-training completo, risparmiando settimane di calcolo.

## I fatti

- 10 vettori soft prompt rappresentano lo 0,0006% dei parametri di un modello da 7 B
- L’addestramento richiede circa 80 passaggi, pari a circa 1,5 minuti su un modello da 7 B

## Perché conta

Permette agli sviluppatori di valutare e classificare rapidamente i modelli senza ricorrere a un costoso addestramento completo, concentrandosi su ciò che il modello sa davvero.

## Fonti e riferimenti

1. [Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation](https://www.aleph-alpha.com/en/blog/soft-prompt-tuning-for-fair-and-efficient-llm-benchmark-evaluation/) – Aleph Alpha, 2026-09-29

Ultimo aggiornamento: 2026-09-29
