My Capstone Project Team и я пытаемся создать функцию вознаграждения, используя код Python в среде Linux. Мы использовали настройку стационарного робота Aloha, подключенную к компьютеру, использующему среду Linux для ввода кода. Наша настройка робота завершена с датчиками и камерами, чтобы помочь роботу изучать и воспроизвести задачи. Моя команда записала более 200 испытаний выполнения этой задачи, и теперь нам нужна установка роботов, чтобы использовать эти записанные испытания, чтобы попытаться выполнить саму задачу. Испытания. Нам нужна функция вознаграждения, чтобы помочь нашему роботу выполнить каждый из этих шагов правильно. Мы не смогли найти способ рассказать о роботе руках, если оно сделало что -то неправильно через функцию вознаграждения. Вместо этого руки робота, казалось, смущены тем, что делать, и не стал негативным вознаграждением, когда оно не сделало что -то правильно. Из около 50 попыток робот Arms успешно выполнил задачу самостоятельно пару раз.
Подробнее здесь: https://stackoverflow.com/questions/795 ... that-is-le