반응형

https://arxiv.org/abs/2607.21655

https://github.com/sterzhang/Awesome-Progress-Models

2026.7.22
[Progress Reward Modeling for Robotic Learning: A Comprehensive Survey]

이 논문은 로봇이 복잡한 과제를 수행할 때 단순히 최종 성공 여부만 확인하는 기존 방식의 한계를 지적하며, 작업의 진행 단계를 실시간으로 평가하는 진행 보상 모델링(Progress Reward Modeling) 분야에 대한 포괄적인 연구를 제공합니다. 저자들은 파편화된 기존 연구들을 체계화하기 위해 모델이 정보를 받아들이는 입력 및 출력 인터페이스, 보상 신호를 생성하는 네 가지 핵심 구축 방법론, 그리고 데이터 생성 및 성능 검증을 위한 벤치마크라는 세 가지 통합적 관점을 제시합니다. 특히 시각-언어 모델(VLM)을 활용하여 로봇의 동작이 목표에 얼마나 근접했는지 수치화하거나 논리적인 코드로 변환하는 최신 기술 동향을 비중 있게 다룹니다. 결과적으로 이 서베이는 현재 기술이 가진 미세한 동작 감지의 어려움이나 장기 기억 능력의 부족과 같은 제약 사항을 분석함으로써, 더욱 정교하고 안정적인 로봇 학습을 위한 미래 연구 방향을 명확히 제시하는 데 목적이 있습니다.

 

 

 

728x90
반응형
Posted by Mr. Slumber
,