LiquidAI hat am 2026-10-03 auf Hugging Face ein neues Modell namens LFM2.5‑350M‑Diffusion‑Exp veröffentlicht. Es funktioniert wie das ursprüngliche Modell LFM2.5‑350M, erzeugt Text aber in Blöcken mit 32 Tokens statt Token für Token. Dieser Block-Diffusionsansatz beschleunigt die Dekodierung, besonders bei kleinen Batch-Größen. Bei acht Entrauschungsschritten pro Block bleibt die Genauigkeit nahe am autoregressiven Modell. Das Modell nutzt dieselbe Architektur, denselben Tokenizer und dieselbe Chat-Vorlage wie LFM2.5.
Warum es wichtig ist
Entwickler können mit einem vertrauten 350‑M-Modell schneller Antworten erhalten, ohne größere Qualitätseinbußen hinnehmen zu müssen.