2026-10-03 LiquidAI добавила на Hugging Face новую модель LFM2.5‑350M‑Diffusion‑Exp. Она работает по тому же принципу, что и оригинальная LFM2.5‑350M, но генерирует текст блоками по 32 токена, а не по одному. Такой подход с блочной диффузией ускоряет декодирование, особенно при небольшом размере пакета, и позволяет сохранить точность, близкую к авторегрессионной версии, если выполнять восемь шагов денойзинга на блок. В модели используются та же базовая архитектура, токенизатор и шаблон чата, что и в LFM2.5.
Почему это важно
Разработчики могут получать ответы быстрее с помощью знакомой модели на 350M параметров, почти не теряя в качестве.