파일은 내 기기에 그대로 있습니다

파일은 브라우저에서 처리되며 우리 서버에 업로드되지 않습니다. 사이트가 처리 엔진을 내려받거나 파일 내용을 제외한 사용 이벤트 또는 의견 이벤트를 보낼 수 있습니다.

데이터 처리 방식

PDF를 CSV로

선택 가능한 텍스트가 있는 보고서 PDF의 표를 표마다 하나씩 CSV 파일로 추출해 다른 도구로 가져올 수 있게 합니다. 파일은 브라우저에 그대로 남습니다.

처음 사용할 때 작은 변환기를 다운로드합니다.

PDF · 최대 10MiB, 200페이지. 텍스트 기반 PDF이며 OCR은 포함되지 않습니다.

감지된 표

예시 사용해 보기

샘플 다운로드

CSV에는 4행 3열이 있어야 하며 품목, 수량, 금액과 합계 148.50이 들어 있습니다. 표가 여러 개이면 별도의 CSV 파일로 ZIP에 담겨 다운로드됩니다.

예상 결과

텍스트가 내장되어 있고 표 행이 규칙적인 PDF용입니다. 스캔본은 먼저 OCR이 필요합니다. 표를 놓치거나 텍스트가 잘못된 셀에 들어갈 수 있으니 다운로드한 파일을 PDF와 비교하세요. 병합된 셀과 원래 서식은 복원되지 않습니다.

표마다 별도의 CSV 파일 또는 Excel 시트가 만들어집니다. 값은 텍스트로 유지됩니다. 수식으로 해석될 수 있는 CSV 값 앞에는 작은따옴표가 붙고, Excel 셀은 명시적으로 텍스트로 저장됩니다. CSV를 스프레드시트로 가져올 때는 앞쪽 0과 숫자 서식을 유지하도록 열을 텍스트로 선택하세요.

입력 최대 10MiB, 200페이지, 표 100개, 셀 100,000개, 열 256개, 출력 최대 8MiB. 처리는 30초 후 중단됩니다. 불규칙한 행은 조용히 밀리지 않고 거부됩니다.

처음 실행할 때는 변환기 파일을 다운로드하느라 잠시 걸릴 수 있습니다. 실패하면 연결을 확인하거나 더 작은 파일로 시도하세요. “취소”는 진행 중인 처리를 중단하며, 다른 파일을 선택하여 다시 시도할 수 있습니다.

엔진 라이선스 및 소스 코드

실용 가이드

보고서의 표를 CSV 파일로

  1. 이미 선택 가능한 텍스트가 있는 보고서 PDF를 선택하세요.
  2. “PDF를 CSV로”를 실행해 표를 찾으세요.
  3. CSV마다 행과 열을 원본 보고서와 비교하세요.

이 예시 사용해 보기

열이 4개, 행이 10개인 보고서 PDF의 결과 표를 추출합니다. CSV에는 10개 행이 모두 같은 열 순서로 있어야 합니다.

시작하기 전에: 스캔한 보고서 페이지는 추출 전에 OCR이 필요하며, 빽빽한 표나 셀이 병합된 표는 잘못 인식되거나 놓칠 수 있습니다.