Pesquisadores liderados por Weizhe Xu lançaram o SafeInferCom, uma ferramenta que monitora um grande modelo de linguagem de raciocínio (LRLM) enquanto ele cria planos para robôs. A ferramenta verifica cada etapa sem interromper o fluxo do modelo, preserva os planos parciais que funcionam e corrige erros logo no início. Testes com vários LRLMs e no simulador VirtualHome mostraram maior sucesso no planejamento e menor uso de tokens, especialmente quando o sistema foi combinado com o refinamento iterativo. A equipe também demonstrou o sistema em um braço robótico real.
Por que importa
Desenvolvedores de robótica podem obter planos mais confiáveis com mais rapidez, economizando computação e tempo na implementação de robôs em situações reais.