OossaAI utvecklas fort. Vi förklarar det enkelt.
Nyhetsbrev

Notis · 1 min läsning

Soft prompt-tuning hjälper riktmärken för språkmodeller att mäta kunskap, inte format

Aleph Alpha visar att det räcker att träna tio små vektorer i en minut för att basmodeller ska kunna svara i rätt format och ge tydligare resultat.

Oossa · Om Oossa

Aleph Alpha har lanserat en metod som justerar endast en handfull träningsbara vektorer – så kallade soft prompts – för att lära en fryst språkmodell exakt vilket svarsformat ett riktmärke kräver. Finjusteringen tar omkring 80 steg, motsvarande ungefär 1,5 minut för en modell med 7 miljarder parametrar, och ökar träffsäkerheten i formatföljandet till nära 100 procent utan att ändra modellens kunskaper.

Eftersom modellens kunskapsresultat förblir oförändrat samtidigt som formateringen förbättras kan forskare jämföra basmodeller på ett rättvist sätt och förutsäga hur de kommer att rankas efter fullständig efterträning – och därmed spara veckor av beräkningstid.

Varför det spelar roll

Det gör att utvecklare snabbt kan utvärdera och rangordna modeller utan kostsam fullständig träning, och fokusera på vad modellen faktiskt kan.

Var den här artikeln användbar?

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation ↗Aleph Alpha29 sep. 2026

1 källor

Senast uppdaterad:

Oossallms.txt.md

Dela

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.