파일은 내 기기에 그대로 있습니다

파일은 브라우저에서 처리되며 우리 서버에 업로드되지 않습니다. 사이트가 처리 엔진을 내려받거나 파일 내용을 제외한 사용 이벤트 또는 의견 이벤트를 보낼 수 있습니다.

데이터 처리 방식

PDF를 CSV로

선택 가능한 텍스트가 있는 PDF의 표를 표마다 CSV 파일 하나씩으로 추출합니다. 스캔한 페이지는 먼저 OCR이 필요합니다. 파일은 브라우저에 그대로 남습니다.

처음 사용할 때 작은 변환기를 다운로드합니다.

PDF · 최대 10MiB, 200페이지. 텍스트 기반 PDF이며 OCR은 포함되지 않습니다.

감지된 표

예시 사용해 보기

샘플 다운로드

CSV에는 4행 3열이 있어야 하며 품목, 수량, 금액과 합계 148.50이 들어 있습니다. 표가 여러 개이면 별도의 CSV 파일로 ZIP에 담겨 다운로드됩니다.

예상 결과

텍스트가 내장되어 있고 표 행이 규칙적인 PDF용입니다. 스캔본은 먼저 OCR이 필요합니다. 표를 놓치거나 텍스트가 잘못된 셀에 들어갈 수 있으니 다운로드한 파일을 PDF와 비교하세요. 병합된 셀과 원래 서식은 복원되지 않습니다.

표마다 별도의 CSV 파일 또는 Excel 시트가 만들어집니다. 값은 텍스트로 유지됩니다. 수식으로 해석될 수 있는 CSV 값 앞에는 작은따옴표가 붙고, Excel 셀은 명시적으로 텍스트로 저장됩니다. CSV를 스프레드시트로 가져올 때는 앞쪽 0과 숫자 서식을 유지하도록 열을 텍스트로 선택하세요.

입력 최대 10MiB, 200페이지, 표 100개, 셀 100,000개, 열 256개, 출력 최대 8MiB. 처리는 30초 후 중단됩니다. 불규칙한 행은 조용히 밀리지 않고 거부됩니다.

처음 실행할 때는 변환기 파일을 다운로드하느라 잠시 걸릴 수 있습니다. 실패하면 연결을 확인하거나 더 작은 파일로 시도하세요. “취소”는 진행 중인 처리를 중단하며, 다른 파일을 선택하여 다시 시도할 수 있습니다.

엔진 라이선스 및 소스 코드

실용 가이드

표를 찾아 CSV로 만듭니다

  1. 선택 가능한 텍스트가 있는 PDF를 선택하세요.
  2. “PDF를 CSV로”를 실행하세요.
  3. CSV마다 행과 열을 원본 표와 비교하세요.

이 예시 사용해 보기

열이 3개, 행이 8개인 표를 PDF에서 추출합니다. CSV에는 같은 8개 행과 3개 열이 있어야 합니다.

시작하기 전에: 복잡하거나 테두리가 없는 표는 놓칠 수 있으며, 스캔한 페이지는 먼저 OCR을 거치기 전에는 결과가 나오지 않습니다.