사용자가 PDF 문서 레이아웃 분석을 위해 DocLayout, MinerU, Marker, Unlimited-OCR 등 다양한 모델을 사용해봤어요. Docling은 성능이 좋지만 과도하게 작동하고, MinerU는 저자 정보나 마스트헤드, 논문 유형을 인식하지 못해요.
Unlimited-OCR은 스타일 인식 능력이 부족하고 로고 인식도 어렵다고 해요. PDF 텍스트 및 레이아웃 추출에 뛰어난 SOTA 모델을 찾고 있어요.
Journals 분석에 적합한 모델을 찾고 있으며, Docling의 과도한 성능과 MinerU의 누락 문제를 해결하고 싶어 합니다.