VTLoc은 시각 정보와 촉각 정보를 융합하여 로봇의 촉각 접촉 위치를 추정하는 새로운 프레임워크입니다. 시각과 촉각 데이터를 결합하여 가상 포인트 클라우드를 재구성하고 시각 포인트 클라우드와 정렬하는 모듈을 도입했습니다. 반복적인 위치 추정 업데이트를 통해 시각과 촉각 데이터를 융합하여 접촉 위치를 정확하게 예측합니다.
실제 환경에서 100개의 물체에 대한 실험 결과, VTLoc은 단일 접촉 위치 추정 성능을 향상시켜 지역-전역 대응 모호성을 줄였습니다. 새로운 벤치마크 데이터셋을 통해 성능을 검증했습니다.
VTLoc은 로봇 인식 및 조작에 필수적인 시각과 촉각 정보를 통합하여 로봇의 작업 효율성을 높이는 데 기여할 것으로 기대됩니다.