OossaA IA evolui rápido. Nós explicamos de forma simples.
Newsletter

Nota · 1 min de leitura

Ajuste de soft prompts ajuda benchmarks de LLMs a avaliar conhecimento, não formato

A Aleph Alpha mostra que treinar apenas dez vetores minúsculos por um minuto permite que modelos-base respondam no formato correto, oferecendo pontuações mais claras.

Oossa · Sobre a Oossa

A Aleph Alpha lançou um método que ajusta apenas alguns vetores treináveis — chamados soft prompts — para ensinar a um modelo de linguagem congelado o formato exato de resposta esperado por um benchmark. O ajuste leva cerca de 80 etapas, ou aproximadamente 1,5 minuto para um modelo de 7 bilhões de parâmetros, e eleva a precisão no cumprimento do formato para quase 100%, sem alterar o conhecimento do modelo.

Como a pontuação de conhecimento do modelo permanece estável enquanto o desempenho na formatação melhora, os pesquisadores podem comparar modelos-base de forma justa e prever sua classificação após o pós-treinamento completo, economizando semanas de computação.

Por que importa

Isso permite que desenvolvedores avaliem e classifiquem modelos rapidamente, sem o custo de um treinamento completo, concentrando-se no que o modelo realmente sabe.

Este artigo foi útil?

Fontes e referências

#FonteVeículoDataPonto principal
1Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation ↗Aleph Alpha29 de set. de 2026

1 fontes

Última atualização:

Oossallms.txt.md

Compartilhar

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.