연구진은 ChatGPT, Gemini, Qwen-Image 등 현대 VLM에서 이미지 조작 탐지 성능을 높이는 도메인 일반화 방법을 연구했어요. 균형 잡힌 미니배치 샘플링과 간단한 레이트 인젝션 전략을 통해 다양한 VLM 환경에서 조작 탐지 모델의 강건성을 확보했어요. 새로운 프레임워크는 기존 PIXAR 대비 평균 gIoU와 cIoU에서 각각 26.1%, 26.8%의 성능 향상을 보여줬어요.