연구진은 시각 문서 이해 모델이 증거 영역을 정확히 지목하는 데 어려움을 겪는 '증거 환각' 현상을 조사했어요. 좌표 기반 인터페이스 대신 텍스트 인용과 페이지 영역 검색을 결합한 새로운 방법을 통해 증거 회수율이 크게 향상되고 환각률이 감소했어요. 새로운 GRPO 학습 방식은 좌표 정보 없이도 모델이 더 나은 증거를 인용하도록 훈련하여 정확도를 향상시켰어요.