LiquidAI añadió el 2026-10-03 a Hugging Face un nuevo modelo llamado LFM2.5‑350M‑Diffusion‑Exp. Funciona como el modelo original LFM2.5‑350M, pero genera texto en bloques de 32 tokens en lugar de uno por uno. Este método de difusión por bloques acelera la decodificación, sobre todo con tamaños de lote pequeños, y mantiene una precisión cercana a la de la versión autorregresiva al usar ocho pasos de eliminación de ruido por bloque. El modelo utiliza la misma arquitectura base, el mismo tokenizador y la misma plantilla de chat que LFM2.5.
Por qué importa
Los desarrolladores pueden obtener respuestas más rápidas con un modelo conocido de 350 M, sin una gran pérdida de calidad.