Sakana AI показала схему SAIL — робот исправляет движение в симуляторе
Sakana AI совместно с Токийским университетом показала SAIL — схему, в которой робот сначала ошибается в симуляторе, а на реальный манипулятор отправляется только исправленная траектория.
Работает это так: модель получает несколько примеров выполнения задачи и предлагает траекторию движения. Её прогоняют в симуляторе, вторая модель смотрит видео прогона и отмечает момент, где робот перестал приближаться к цели. Система переписывает неудачный участок и пробует снова.
В симуляции проверяли на шести разных задачах. На физическое железо уходит только та траектория, которая прошла отбор, — цена ошибки переносится с реального робота на прогон в симуляторе.