Des chercheurs dirigés par Weizhe Xu ont présenté SafeInferCom, un outil qui surveille un grand modèle de langage raisonneur (LRLM) pendant qu’il élabore des plans pour des robots. Il vérifie chaque étape sans interrompre le modèle, conserve les plans partiels qui tiennent la route et corrige les erreurs dès qu’elles apparaissent. Des tests menés avec plusieurs LRLM et dans le simulateur VirtualHome ont montré une meilleure réussite de la planification et une consommation réduite de jetons, en particulier lorsque l’outil est associé à un processus d’amélioration itératif. L’équipe a également testé le système sur un bras robotisé réel.
Pourquoi c'est important
Les développeurs en robotique peuvent obtenir plus rapidement des plans plus fiables, et ainsi économiser du temps et de la puissance de calcul lors du déploiement de robots dans le monde réel.