LiquidAIは2026-10-03、Hugging Faceに「LFM2.5‑350M‑Diffusion‑Exp」を追加した。このモデルは従来のLFM2.5‑350Mと同じように動作するが、1トークンずつではなく、32トークン単位でテキストを生成する。このブロック拡散方式により、特にバッチサイズが小さい場合のデコードが高速化する。ブロックごとに8回のノイズ除去を行えば、自己回帰型モデルに近い精度を保てる。バックボーン、トークナイザー、チャットテンプレートはLFM2.5と同じだ。
なぜ重要か
開発者は、使い慣れた3億5000万パラメーターのモデルを使いながら、品質を大きく損なわずに応答を高速化できる。