Исследователи под руководством Гэнцзэ Чжоу представили NavGPT-3 — систему, которая связывает большую языковую модель с быстродействующей политикой управления действиями робота. В ней рассуждение, выполнение действий и мониторинг работают в отдельных потоках, поэтому робот может быстро прерывать задачу и переключаться на другую. Политика управления с 8 миллиардами параметров, обученная на 19,28 миллиона примеров, уже показала успешность 74,5% на тесте R2R‑CE. С полной системой NavGPT-3 повысила результат на этом тесте до 81,5% и сравнялась с людьми на RxR‑CE, проходя маршрут примерно за 1 минуту 22 секунды за эпизод.
Почему это важно
Система показывает, что роботы могут сочетать рассуждения на естественном языке с быстрым управлением на низком уровне. Это приближает автономную навигацию к человеческой скорости и надёжности.