norgitov/ trends
Технологии · люди · идеи
К обзору/Daily Papers1 час назад

InterEvolve: Эволюция программ вознаграждений в процессе тестирования для локомоторно-манипуляционных задач у человеческих роботов

В статье представлена методика InterEvolve для эволюции программ вознаграждений в процессе тестирования для локомоторно-манипуляционных задач у человеческих роботов. Метод использует объектно-ориентированную фундаментальную модель поведения и агента на основе больших языковых моделей для пересмотра программ вознаграждений на основе обратной связи от выполнения и библиотеки навыков, позволяя контроллерам адаптироваться к новым задачам без повторного обучения.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
4
голосов источника
Наблюдаем с2 октября 2026 г.4 голосов источника
Темп интереса—Нужны повторные замеры
Опубликовано1 октября 2026 г.Zhuo Lin, Sirui Xu, Liuyu Bian
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

4 голосов источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Этот подход позволяет человеческим роботам адаптироваться к новым задачам, эволюционируя программы вознаграждений во время тестирования, используя существующие навыки и обратную связь без повторного обучения.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема