A LiquidAI disponibilizou no Hugging Face, em 2026-10-03, um novo modelo chamado LFM2.5‑350M‑Diffusion‑Exp. Ele funciona como o modelo original LFM2.5‑350M, mas gera texto em blocos de 32 tokens, em vez de um token por vez. Essa abordagem de difusão em blocos acelera a decodificação, especialmente com tamanhos de lote pequenos, mantendo a precisão próxima à da versão autorregressiva quando são usadas oito etapas de remoção de ruído por bloco. O modelo usa a mesma arquitetura-base, o mesmo tokenizador e o mesmo modelo de chat do LFM2.5.
Por que importa
Os desenvolvedores podem obter respostas mais rápidas com um modelo conhecido de 350 milhões de parâmetros, sem grande perda de qualidade.