참고팁Reddit
14개 PDF 파싱 도구 벤치마크 결과: Chandra 모델, 테이블 및 수식 인식에서 압도적
문서 처리 파이프라인 구축 시 도구 선정의 기준이 되는 최신 벤치마크 데이터로 활용 가능.
요약
최근 Reddit의 r/LocalLLaMA 커뮤니티에서 8개 PDF 파싱 도구의 14가지 기능을 비교한 성능 테스트 결과가 공유되었다. 비교 대상에는 MinerU 2.5, Granite-Docling, PaddleOCR-VL, XBerg 1.0, HURIDOCS PDLA, LiteParse 2.11, Chandra, LightOnOCR-1B가 포함되었다. 테스트 결과 Datalab의 Chandra 모델이 14개 평가 항목 모두에서 가장 우수한 성능을 보이며 종합 1위를 차지했다. Chandra는 특히 병합된 셀이 포함된 HTML 테이블 추출, LaTeX 수식 변환, 필기체 인식 및 텍스트 서식 유지에서 압도적인 정확도를 기록했다. 이번 벤치마크는 다양한 문서 타입 처리에 최적화된 파서 선택 기준을 실무자들에게 제시하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 I compared even more parsers on 14 PDF-parsing capabilities using different types
원문 보기 ↗