Jinzhou Li liderliğindeki araştırmacılar, simülasyonda eğitilen becerikli el politikalarını gerçek donanıma uyarlamak için ReDex’i geliştirdi. Sistem, temel politika diğer parmakları kontrol etmeyi sürdürürken bir insanın parmakların temas noktalarını nazikçe düzeltmesine olanak tanıyor. Temel politika çıktılarının, insan yönlendirmeli parmak hareketlerinin ve parmak ucu kuvvet verilerinin bir araya getirildiği denemeler, davranış klonlama yoluyla kuvvete koşullandırılmış yeni bir politikayı eğitmek için kullanılıyor. Temasın yoğun olduğu iki görevde yapılan testlerde ReDex, nesne çevirme başarısını %14’ten %86’ya, tornavida döndürme ilerlemesini ise %26’dan %95,3’e yükseltti.
Neden önemli
Bu yöntem, simülasyonda öğrenilen el becerilerini çok az insan düzeltmesiyle gerçek dünyada güvenilir robot hareketlerine dönüştürmenin pratik bir yolunu sunuyor.