연구진은 대규모 시각-언어 모델(LVLM) 기반 산업 이상 감지(IAD) 방법의 정확도를 높이기 위해 새로운 프레임워크 OPD-IAD를 제안했어요.
OPD-IAD는 언어 판단을 기반으로 픽셀 단위의 이상 감지를 수행하며, 언어적 지침과 시각적 반응의 균형을 맞추는 데 중점을 뒀어요.
언어 판단을 기반으로 픽셀 단위의 이상 감지 지도를 생성하는 Language-guided Visual Anchoring 기법을 도입하여 기존 방법보다 우수한 성능을 보였어요.