# El ajuste con soft prompts ayuda a que las pruebas de referencia midan el conocimiento, no el formato

> Aleph Alpha muestra que basta con entrenar diez pequeños vectores durante un minuto para que los modelos base respondan en el formato correcto y obtengan puntuaciones más claras.

Oossa · 2026-09-29 · https://oossa.com/es/soft-prompt-tuning-helps-llm-benchmarks-focus-on-knowledge-not-format

Aleph Alpha presentó un método que ajusta solo unos pocos vectores entrenables —llamados soft prompts— para enseñar a un modelo de lenguaje congelado el formato exacto de respuesta que espera una prueba de referencia. El ajuste requiere unos 80 pasos, alrededor de 1,5 minutos en un modelo de 7.000 millones de parámetros, y eleva la precisión al seguir el formato hasta casi el 100 % sin modificar los conocimientos del modelo.

Como la puntuación de conocimientos del modelo no cambia mientras mejora el formato, los investigadores pueden comparar los modelos base en igualdad de condiciones y predecir cómo se clasificarán después de un postentrenamiento completo, con lo que ahorran semanas de cómputo.

## Los hechos

- 10 vectores de soft prompt representan el 0,0006 % de los parámetros de un modelo de 7 B
- El entrenamiento requiere unos 80 pasos, alrededor de 1,5 minutos en un modelo de 7 B

## Por qué importa

Permite a los desarrolladores evaluar y clasificar modelos rápidamente, sin un costoso entrenamiento completo, y centrarse en lo que el modelo realmente sabe.

## Fuentes y referencias

1. [Soft-Prompt Tuning for Fair and Efficient LLM Benchmark Evaluation](https://www.aleph-alpha.com/en/blog/soft-prompt-tuning-for-fair-and-efficient-llm-benchmark-evaluation/) – Aleph Alpha, 2026-09-29

Última actualización: 2026-09-29
