Oossa

LiquidAI lance une version à diffusion par blocs de LFM2.5

Ce nouveau modèle de 350M paramètres débruite des blocs de 32 tokens pour générer du texte plus rapidement, avec des résultats proches de l’original sur la plupart des benchmarks.

BrèveOossaPublié par Oossa: 1 min de lecture

LiquidAI a ajouté sur Hugging Face, le 2026‑10‑03, un nouveau modèle appelé LFM2.5‑350M‑Diffusion‑Exp. Il fonctionne comme le modèle LFM2.5‑350M original, mais génère le texte par blocs de 32 tokens plutôt qu’un token à la fois. Cette approche de diffusion par blocs accélère le décodage, en particulier avec de petites tailles de batch, tout en maintenant une précision proche de celle de la version autorégressive avec huit étapes de débruitage par bloc. Le modèle utilise le même backbone, le même tokenizer et le même template de conversation que LFM2.5.

Pourquoi c'est important

Les développeurs peuvent obtenir des réponses plus rapides avec un modèle familier de 350 M, sans perte importante de qualité.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.