Il 2026-10-03 LiquidAI ha aggiunto a Hugging Face un nuovo modello, chiamato LFM2.5‑350M‑Diffusion‑Exp. Funziona come l’originale LFM2.5‑350M, ma genera testo in blocchi da 32 token anziché un token alla volta. Questo approccio di block diffusion accelera la decodifica, soprattutto con batch di piccole dimensioni, mantenendo un’accuratezza simile a quella della versione autoregressiva con otto passaggi di denoising per blocco. Il modello usa lo stesso backbone, tokenizer e template di chat di LFM2.5.
Perché conta
Gli sviluppatori possono ottenere risposte più rapide con un modello familiare da 350 M senza perdere molta qualità.