NVIDIA a publié Kumo Tabular sur Hugging Face. Le modèle prédit les étiquettes de nouvelles lignes à partir d’un tableau annoté, sans entraînement ni ingénierie des caractéristiques. Il est proposé en trois tailles : Small (environ 28 M de paramètres), Medium (environ 71 M) et Large (environ 215 M). Au classement TabArena, il arrive en tête avec un score Elo de 1950 et fonctionne environ 17 % plus vite que le précédent meilleur modèle, LimiX‑2, lors d’une évaluation sur un seul GPU RTX 6000 Pro. Ces mêmes modèles occupent également la première place sur BeyondArena, TALENT et ScoringBench.
Pourquoi c'est important
Les entreprises peuvent remplacer leurs pipelines tabulaires sur mesure par un seul modèle préentraîné, à la fois plus précis et plus rapide à exécuter.