LlamaIndex, 엑셀/CSV 데이터 직접 추출하는 '네이티브 스프레드시트 파싱' 지원
기존 텍스트 변환 방식 대신 구조적 데이터 보존으로 복잡한 표 데이터 처리 정확도 향상.
요약
기존 데이터 추출 도구는 스프레드시트를 PDF처럼 다루며 텍스트나 마크다운으로 변환해 데이터의 구조적 맥락을 훼손하는 문제를 안고 있다. 스프레드시트의 헤더, 수식, 병합된 셀 등은 데이터 해석에 필수적이지만, 단순 변환 과정에서 잘못된 지표나 기간으로 매핑될 위험이 크다. 이에 LlamaIndex는 스프레드시트의 구조를 유지하며 데이터를 추출할 수 있는 네이티브 기능을 LlamaParse 플랫폼에 새롭게 추가했다. 해당 기능은 워크북을 텍스트로 평탄화하지 않고 원본 셀을 직접 읽어 사용자가 정의한 스키마에 데이터를 정확히 매핑한다. 현재 .xlsx, .xls, .csv 파일을 지원하며 agentic_plus 티어에서 즉시 이용 가능하다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @llama_index: Most extraction tools treat spreadsheets like PDFs. They flatten the file into text or markdown, then ask a model to infer the ori
원문 보기 ↗