본 논문은 로봇 학습 환경에서 진행 보상 모델링에 대한 종합적인 조사를 제공합니다. 기존 연구들은 진행 상황에 대한 피드백을 제공하는 진행 보상 모델을 탐구했지만, 통일된 프레임워크가 부족했습니다. 본 조사는 진행 모델의 인터페이스, 구축 방법, 데이터 및 벤치마크를 세 단계로 나누어 분석합니다. 향후 연구 방향을 제시하며, 현재 접근 방식의 한계를 요약합니다.