PDF에서 표 추출
스캔본을 포함해 PDF에서 표 추출은 어떻게 하나요?
Linnk의 PDF에서 표 추출 도구에 파일을 올리면, 찾아낸 모든 표가 Excel 통합 문서로 옮겨집니다. 소프트웨어에서 내보낸 PDF든 복사기로 스캔한 PDF든 마찬가지입니다. 어려운 쪽은 후자입니다. 많은 PDF 표 추출 도구는 파일 안에 숨은 텍스트 레이어를 읽는데, 스캔한 페이지에는 그런 레이어가 없고 이미지만 있습니다. Linnk는 페이지 이미지 자체를 읽습니다. AI 모델(Linnk는 ChatGPT, Claude, Gemini 모델을 사용합니다)이 각 페이지를 구조화된 텍스트로 다시 만들고 표를 골라낸 뒤, 표마다 시트 1개, 페이지 기준 시트 이름, 실제 병합 셀로 유지한 머리글로 통합 문서에 기록합니다. 같은 작업에서 표별 CSV, 페이지처럼 보이는 레이아웃 스프레드시트, 검색 가능한 PDF도 받을 수 있습니다. 금액, 날짜, 계좌번호는 한 자리씩 그대로 옮겨지며, 모델이 알아볼 수 없는 숫자는 추측하지 않고 물음표로 표시합니다. 알아 두실 한계는 두 가지입니다. 여러 페이지에 걸친 표는 하나로 합쳐지지 않고 페이지마다 시트 1개로 나오며, 표가 없는 PDF에는 행을 지어내지 않고 표가 없다는 안내가 붙습니다. 반듯하고 밝게 스캔한 페이지가 보통 가장 잘 읽히며, 흐리거나 기울어진 페이지는 간단한 확인이 필요할 수 있습니다.
Last updated: 2026년 10월
PDF에서 표 추출 후 Excel로 받는 방법
설치 없이 온라인에서 세 단계로 끝나는 PDF 표 추출.
PDF 올리기
스캔한 PDF나 디지털 PDF를 끌어다 놓으세요. 출력 형식은 Excel이 이미 선택되어 있고, 출력 언어는 '원본 언어 유지'로 설정되어 있습니다. 모든 페이지를 이미지로 읽기 때문에 복사기 스캔본도 소프트웨어에서 내보낸 보고서와 같은 과정을 거칩니다.
첫 번째 표 확인
보통 페이지당 1분 이내에 미리보기가 첫 번째 표를 격자로 보여 줍니다(표시되는 행 수에는 한도가 있습니다). 인식된 텍스트 복사는 무료입니다. 나머지 표는 다운로드 파일에 들어 있습니다. 먼저 물음표가 있는 셀을 확인하세요. 스캔에서 또렷하게 보이지 않은 숫자입니다.
Excel 통합 문서 다운로드
무료 계정으로 로그인하면 다운로드할 수 있습니다. CSV 파일(표마다 1개, 여러 개면 ZIP으로 묶음), 레이아웃 스프레드시트, 검색 가능한 PDF는 같은 변환에서 만들어지며, Markdown과 일반 텍스트도 마찬가지입니다. Word 파일이 필요하면 요청하실 때 몇 분 더 걸려 만들어집니다.
깔끔한 디지털 파일만이 아니라, 스캔한 PDF에서 표 추출까지 염두에 두고 만들었습니다
은행 거래내역서, 세금계산서, 사업보고서, 검사 결과지, 종이로 시작한 보관 문서까지.
표마다 시트 1개, 시트 이름은 페이지 기준
12페이지에 재무상태표, 14페이지에 현금흐름표가 있는 사업보고서라면 각 페이지 이름이 붙은 시트 2개가 나옵니다. 숫자가 이상해 보일 때 바로 원본 페이지로 돌아갈 수 있습니다. 병합된 머리글 셀은 실제 병합 셀로 유지되어 2단 머리글도 PDF와 같은 모습입니다.
디지털 PDF뿐 아니라 스캔 PDF도 엑셀 변환
많은 표 추출 도구는 스캔본에는 없는 텍스트 레이어에 의존합니다. Linnk는 페이지 이미지를 읽기 때문에 팩스로 받은 명세서, 복사기 스캔본, 오래된 보관 문서도 내보낸 보고서와 같은 방식으로 Excel로 옮길 수 있습니다. 반듯하고 깨끗한 스캔본이 가장 잘 읽힙니다.
숫자는 추측하지 않고 그대로
금액, 계좌번호, 날짜, 수량은 한 자리씩 그대로 옮깁니다. 너무 흐려 읽을 수 없는 숫자는 물음표로, 판독할 수 없는 부분은 [illegible]로 표시되므로 열 합계를 내기 전에 어떤 셀을 확인해야 할지 알 수 있습니다.
없는 표를 지어내지 않습니다
PDF에 표가 없으면 Excel 통합 문서와 CSV가 행을 만들어 내는 대신 표가 없다고 알려 줍니다. 같은 업로드에서 레이아웃 스프레드시트, 검색 가능한 PDF, Markdown, 일반 텍스트는 그대로 받을 수 있습니다.
언어는 그대로, 또는 번역까지
원래 언어를 유지하거나 같은 작업에서 번역할 수 있습니다. 기본 설정에서는 중국 거래처의 명세서가 중국어 그대로 나오며, 한국어, 일본어, 아랍어, 히브리어 표도 각자의 문자로 읽습니다.
같은 업로드에서 CSV와 레이아웃 사본까지
Excel 파일 외에도 표마다 UTF-8 CSV가 제공되어 한글 같은 비라틴 문자나 악센트가 있는 문자도 제대로 열리며, 원본처럼 보이는 페이지당 시트 1개의 레이아웃 스프레드시트와 실제 텍스트로 다시 만든 검색 가능한 PDF도 함께 받습니다.
PDF 표 추출 한눈에 보기
PDF를 올리기 전에 알아 두면 좋은 내용입니다.
입력
- 스캔본 또는 디지털
- 이미지
- JPG, PNG, WEBP, HEIC, HEIF
- 지원하지 않음
- Word, PowerPoint, Excel
- 언어
- 기본적으로 원문 유지
출력
- Excel(표)
- 표마다 시트 1개, 페이지 기준 이름
- CSV
- 표마다 파일 1개, UTF-8
- 스프레드시트(레이아웃)
- 페이지당 시트 1개, 페이지와 비슷한 배치
- 여러 페이지에 걸친 표
- 페이지마다 시트 1개, 합치지 않음
정확도
- 숫자와 날짜
- 한 자리씩 그대로 옮김
- 읽을 수 없는 숫자
- ?로 표시, 추측하지 않음
- 병합 셀
- 실제 병합 셀로 유지
- 표가 없는 PDF
- 안내만 표시, 지어내지 않음
속도 및 이용
- 속도
- 보통 페이지당 1분 이내
- 미리보기
- 무료, 계정 불필요
- 다운로드
- 무료 계정
- 긴 문서
- 유료 요금제, linnk.ai/pricing 참고
PDF에서 표 추출 방법 비교
PDF 표를 Excel로 옮기는 일반적인 방법과 Linnk를 비교했습니다.
| Feature | Linnk PDF에서 표 추출 | 복사해서 붙여넣기 | 텍스트 레이어 기반 표 추출 도구 | 스프레드시트 앱의 PDF 가져오기 |
|---|---|---|---|---|
| 스캔한 PDF | 페이지 이미지에서 읽음 | 보통 선택할 텍스트가 없음 | 보통 OCR을 먼저 거쳐야 함 | 보통 텍스트 기반 PDF가 필요함 |
| PDF 하나에 표가 여러 개 | 표마다 시트 1개, 페이지 기준 이름 | 하나씩 직접 | 보통 하나씩 선택 | 감지된 표 목록에서 선택 |
| 병합된 머리글 셀 | 실제 병합 셀로 유지 | 보통 사라짐 | 도구마다 다름 | 도구마다 다름 |
| 흐리거나 읽을 수 없는 숫자 | 물음표로 표시 | 사용자 판단 | 디지털 PDF는 텍스트 레이어에서 복사 | 디지털 PDF는 텍스트 레이어에서 복사 |
| 여러 페이지에 걸친 표 | 페이지마다 시트 1개, 합치지 않음 | 직접 이어 붙임 | 도구마다 다름 | 도구마다 다름 |
| 표의 언어 | 유지, 또는 같은 작업에서 번역 | 유지 | 유지 | 유지 |
| 같은 파일에서 받는 다른 출력 | CSV, 레이아웃 스프레드시트, 검색 가능한 PDF, Markdown, 텍스트 | 없음 | 도구마다 다름, 주로 CSV | 통합 문서만 |
2026년 9월 기준 비교입니다. 다른 도구는 버전과 설정에 따라 다르므로 최신 기능은 각 도구에서 확인하세요.
Linnk로 PDF 표를 꺼내 쓰는 사람들
PDF 속에 갇힌 숫자를 스프레드시트로 옮겨야 하는 분들.
회계사·경리 담당자
스캔한 은행 거래내역서와 카드 명세서에서 거래 내역 표를 뽑아 대사 작업에 씁니다. 명세서의 각 페이지가 별도 시트로 들어가 하나의 원장에 붙여 넣기 좋습니다.
재무 분석가
사업보고서 PDF의 재무상태표와 손익계산서를 숫자를 다시 치지 않고 모델로 옮긴 뒤, 표시된 셀만 확인합니다.
매입·구매 담당자
스캔 PDF로 들어오는 공급업체 세금계산서와 단가표를 발주서와 대조할 수 있는 행 데이터로 바꿉니다.
연구자·학생
스캔본으로만 남아 있는 오래된 학술지 논문과 학위 논문에서 데이터 표를 꺼내 스프레드시트나 통계 프로그램에 넣습니다.
감사·컴플라이언스 팀
스캔한 신고 서류, 인허가 문서, 점검 대장의 표를 표본 추출용 통합 문서로 옮기며, 시트 이름마다 원본 페이지가 남습니다.
수입·물류 팀
PDF로 받은 패킹 리스트, 운임표, 통관 서류를 원래 언어 그대로 Excel로 변환해 품명이 공급업체 표기와 일치하도록 합니다.