LiquidAI于2026‑10‑03在Hugging Face上发布了一款名为LFM2.5‑350M‑Diffusion‑Exp的新模型。它的工作方式与原版LFM2.5‑350M相似,但生成文本时以32个token为一块,而不是一次生成一个token。这种块扩散方法能够加快解码速度,尤其是在批量较小时;每块采用8步去噪时,准确度也与自回归版本接近。该模型使用与LFM2.5相同的骨干网络、分词器和聊天模板。
为什么重要
开发者可以使用熟悉的350 M模型获得更快的响应,而无需大幅牺牲质量。
这款拥有350M参数的新模型以32个token为一块进行去噪,加快文本生成速度;多数基准测试成绩与原版相当。
简讯OossaOossa 发布日期: 1 分钟阅读
LiquidAI于2026‑10‑03在Hugging Face上发布了一款名为LFM2.5‑350M‑Diffusion‑Exp的新模型。它的工作方式与原版LFM2.5‑350M相似,但生成文本时以32个token为一块,而不是一次生成一个token。这种块扩散方法能够加快解码速度,尤其是在批量较小时;每块采用8步去噪时,准确度也与自回归版本接近。该模型使用与LFM2.5相同的骨干网络、分词器和聊天模板。
开发者可以使用熟悉的350 M模型获得更快的响应,而无需大幅牺牲质量。
最后更新: ·Markdown
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。