Epix / 업무자동화

PDF 표 Excel로 옮기기: Acrobat·Power Query 추출과 숫자 검산

PDF가 스캔 이미지인지 먼저 확인한 뒤 Excel Power Query 또는 Acrobat으로 표를 추출하세요. 메뉴 제공 범위는 플랫폼·버전·계정마다 다릅니다. 결과는 행 수·식별값·날짜·행별 금액과 원본 합계까지 대조해야 업무에 사용할 수 있습니다.

PDF 표를 Excel로 옮길 때는 PDF가 스캔 이미지인지 먼저 확인한 뒤, 선택 가능한 표는 Power Query 또는 Acrobat으로 추출하고 행 수·계산 합계·원본의 숫자를 대조하세요. Windows Excel에 데이터 → 데이터 가져오기 → 파일에서 → PDF에서가 있으면 Navigator에서 표를 선택해 변환할 수 있습니다. 메뉴가 없거나 PDF 레이아웃을 표로 인식하지 못하면 Acrobat의 XLSX 내보내기를 사용합니다. 스캔 PDF는 먼저 OCR을 적용해야 합니다. 추출만 하고 바로 업무에 쓰지 말고, 앞자리 0이 있는 코드·날짜·수량×단가·총액을 검수하세요.

PDF 표 추출·Excel 검수 · Adobe Acrobat 및 Microsoft 공식 도움말 확인: 2026년 10월 10일 · 메뉴와 기능은 앱 버전·플랫폼·계정에 따라 다를 수 있습니다.

PDF 종류를 구분하고 Acrobat 또는 Power Query로 표를 추출한 뒤 데이터 행 수와 금액을 검산하는 흐름
변환 도구보다 먼저 원본 표의 행 수와 합계를 기록해 두면 결과가 맞는지 확인할 수 있습니다.

급여·거래처·고객·진료·신분 자료는 조직에서 승인하지 않은 온라인 변환 사이트에 올리지 마세요. 승인된 Acrobat이나 사내 PC의 Power Query를 이용하고 원본 PDF는 별도 보관합니다. 아래 실습 파일과 숫자는 모두 가상 예시입니다.

Acrobat과 Power Query 중 결과에 맞는 방법을 고릅니다

같은 PDF라도 선택 가능한 텍스트 표인지, 종이를 찍은 스캔인지에 따라 출발점이 다릅니다. 표가 여러 페이지에 걸쳐 있는지, 통화 기호·병합 셀이 있는지도 결과를 좌우합니다. 원본의 표가 단순하고 Excel에 PDF 가져오기 메뉴가 있으면 Power Query부터 시험할 수 있습니다. 페이지별 시트나 숫자 구분 기호를 세밀하게 조절해야 하거나 Power Query가 표를 제대로 찾지 못하면 Acrobat 변환 설정을 살펴봅니다.

상황먼저 쓸 방법확인할 조건
Windows Excel에서 PDF 표를 선택할 수 있고 반복 갱신도 필요Power Query PDF 커넥터현재 Excel에 PDF 메뉴가 있는지, Navigator가 각 표를 어떻게 나누는지 확인
표·페이지별 시트, 천 단위·소수 구분을 지정하고 싶음Acrobat의 Microsoft Excel(XLSX) 내보내기Acrobat 제품과 계정에서 내보내기를 사용할 수 있는지 확인. Reader의 PDF 내보내기는 유료 Export PDF 구독이 필요할 수 있음
마우스로 글자를 선택할 수 없고 페이지 전체가 이미지처럼 잡힘복사본에 OCR을 먼저 적용인식 언어·페이지 범위를 선택하고 중요 숫자를 원본 이미지와 직접 대조
Mac Excel에서 데이터 가져오기 메뉴만 있고 PDF 항목이 없음Acrobat 또는 승인된 Windows Excel 환경Microsoft의 커넥터 지원표에서 Mac 목록에 로컬 PDF 원본이 포함되는지 확인. 모든 플랫폼에 메뉴가 있다고 가정하지 않음
PDF 표의 텍스트가 적고 몇 행만 필요복사·붙여넣기 후 직접 정리열이 밀리거나 숫자 형식이 텍스트로 들어오지 않았는지 검산

Power Query는 PDF 안에서 찾은 표를 Navigator에 보여 주고, 불러오기 전에 변환 단계를 적용할 수 있습니다. 다만 PDF는 셀 데이터베이스가 아니라 페이지 배치 형식입니다. 선이 없거나 병합 셀이 많으면 여러 행을 한 셀로 합치거나 하나의 행을 여러 줄로 쪼갤 수 있습니다. Acrobat 변환도 읽을 수 있는 XLSX를 만들 뿐 원본의 표 구조와 숫자가 모두 정확하다는 보증은 아닙니다.

원본 PDF에서 텍스트 표와 스캔 이미지를 나눕니다

  1. PDF 사본을 뷰어에서 열고 표 안의 단어를 드래그합니다. 단어 일부가 선택되면 텍스트 PDF일 가능성이 높고, 페이지 전체가 사각형으로 선택되면 스캔 이미지일 수 있습니다.
  2. 표의 숫자 한 개를 복사해 텍스트 편집기에 붙여 넣습니다. 숫자 순서가 바뀌거나 빈칸·이상한 문자가 나오면 단순히 복사해도 Excel에서 열이 깨질 수 있습니다.
  3. 앞·중간·끝 페이지에서 각각 시험합니다. 한 문서 안에 디지털 텍스트와 스캔 페이지가 섞일 수 있으므로 첫 페이지만 보고 전체를 판단하지 않습니다.
  4. PDF의 눈에 보이는 표에 제목 행·페이지 번호·소계 행이 있는지 확인합니다. 이런 행은 Excel 데이터로 잘못 섞이기 쉽습니다.

글자를 선택할 수 있는데 복사 결과가 깨진다면 OCR을 반복 실행하기보다 만든 사람에게 원본 Excel이나 검색 가능한 PDF를 요청하는 편이 정확할 수 있습니다. 스캔 PDF라면 다음 OCR 절차를 거친 뒤, 표가 추출 가능한 구조로 보이는지 다시 확인합니다. 텍스트 검색이 안 되는 이유와 OCR을 적용하는 방법은 PDF 검색·복사 안 될 때 OCR 진단에 별도로 정리했습니다.

변환 전에 PDF의 기준 행 수와 합계를 적습니다

비교할 기준값 없이 Excel 결과만 보면 일부 행이 빠졌는지 알아채기 어렵습니다. 원본 PDF의 표에서 실제 데이터 행 수와 총액을 먼저 세고, 머리글·페이지 번호·중간 소계는 데이터 행에 포함하지 않습니다. 페이지 하단에 총액이 표시되어 있으면 그 값을 별도 기록합니다. PDF가 여러 표나 여러 구간으로 나뉘면 각 구간의 행 수와 소계를 따로 적습니다.

  1. 표 제목과 날짜 범위를 기록합니다. 제목이나 기간이 여러 페이지마다 반복되면 반복 행을 데이터로 가져오지 않도록 표시합니다.
  2. 열 이름을 적습니다. 예: 날짜, 지점코드, 지점, 품목, 수량, 단가, 금액.
  3. 데이터 행 개수를 직접 세거나 PDF 원본에서 마지막 행 번호를 확인합니다. 중간 제목과 소계 행은 별도로 구분합니다.
  4. 원본 하단의 총액 또는 확실한 소계가 있으면 함께 기록합니다. 단위가 원인지 천원인지도 적습니다.
  5. PDF 원본과 출력 Excel의 저장 위치를 분리합니다. 원본 파일에 덮어쓰지 않고, 추출본에는 날짜나 버전을 붙입니다.

PDF가 한 페이지짜리 정적 증빙이라면 복사·붙여넣기로 충분할 수 있습니다. 매달 같은 모양의 PDF에서 표를 다시 가져오거나 변환 단계를 반복해야 한다면 Power Query가 더 편합니다. 반복 갱신을 설정해도 각 새 PDF의 행 수와 합계는 다시 확인해야 합니다.

Windows Excel Power Query에서 PDF 표를 불러옵니다

Microsoft 도움말의 데스크톱 흐름은 PDF 커넥터 선택 → 파일 선택 → Navigator에서 가져올 항목 선택 → Load 또는 Transform Data입니다. Excel 버전·라이선스와 운영체제에 따라 메뉴가 달라질 수 있습니다. Excel의 데이터 → 데이터 가져오기 → 파일에서 → PDF에서가 보일 때 다음 순서로 진행합니다.

  1. 데이터 탭에서 데이터 가져오기를 선택하고 파일에서 → PDF에서를 엽니다. 파일 선택 창에서 원본 PDF 또는 작업용 사본을 고릅니다.
  2. Navigator에 표시된 Table 항목과 Page 항목을 비교합니다. 표 모양으로 분리된 후보를 선택하고 미리보기의 머리글·첫 행·마지막 행을 확인합니다.
  3. 한 페이지마다 표가 나뉘어 보이면 필요한 항목이 모두 포함됐는지 확인합니다. 페이지마다 열 이름이 반복되거나 제목 행이 데이터에 섞였으면 우선 Transform Data(데이터 변환)를 선택합니다.
  4. Power Query 편집기에서 불필요한 상단 행·하단 소계·반복 머리글만 제거합니다. 행마다 셀이 나뉜 문장이 있으면 원본 페이지에서 실제 같은 행인지 확인한 뒤에만 병합하거나 채웁니다.
  5. 열 제목을 명확하게 고치고 자료형을 지정합니다. 날짜는 날짜, 수량·단가·금액은 숫자, 지점코드·주문번호는 앞자리 0을 보존할 수 있도록 텍스트로 둡니다.
  6. 닫기 및 로드를 눌러 새 워크시트로 가져옵니다. 원본 PDF의 기준 행 수·총액과 Excel 행 수·합계를 대조하고, 결과를 별도 이름으로 저장합니다.

PDF 커넥터가 안 보이면 Excel 메뉴에서 같은 이름을 계속 찾지 말고 현재 제품과 플랫폼을 먼저 확인하세요. Microsoft 커넥터 표는 Windows 데스크톱 일부 Microsoft 365 버전 등과 Excel for Mac을 구분합니다. 현재 메뉴가 없으면 Acrobat에서 XLSX로 내보내거나 승인된 Windows 장치에서 가져옵니다. 브라우저의 Excel에서 로컬 PDF를 직접 여는 기능과 조직용 SharePoint/OneDrive 문서를 새로 고치는 지원도 구분해야 합니다.

Navigator의 항목 수가 PDF의 페이지 수와 같지 않을 수 있습니다. 한 테이블이 여러 페이지에 걸쳐 하나의 항목으로 잡히거나 페이지별 Table 항목이 여러 개 나타날 수 있습니다. 항목을 하나만 선택하기 전에 PDF 전체 페이지의 표가 포함됐는지 미리보기와 최종 행 수로 확인합니다.

Acrobat에서 PDF 표를 XLSX로 내보냅니다

Adobe 도움말 기준 데스크톱 Acrobat의 변환 경로는 전체 도구 모음 → 변환 → Microsoft Excel → XLSX → XLSX로 변환입니다. 메뉴명이 다르면 현재 Acrobat 화면에서 Excel 내보내기 도구를 찾습니다. Acrobat Reader를 사용 중이면 유료 Acrobat Export PDF 서비스 구독이 필요할 수 있으므로 버튼이 보이는지만으로 무료 기능이라고 판단하지 마세요.

  1. PDF 원본을 복사한 뒤 복사본을 Acrobat에서 엽니다. 민감한 PDF는 조직 계정과 허용된 장치에서만 처리합니다.
  2. 변환을 열고 왼쪽에서 Microsoft Excel, 형식으로 XLSX를 고른 다음 변환을 시작합니다.
  3. 설정이 필요하면 설정에서 워크시트를 표별·페이지별·전체 문서 중 어떤 기준으로 만들지 고릅니다. 기본값을 그대로 둘 수 있는 단순 PDF라도 미리보기에서 표가 어떻게 묶였는지 확인합니다.
  4. 숫자의 소수점과 천 단위 구분 기호를 원본 표기와 맞춥니다. 통화 기호가 셀 값에 붙는지 서식으로 분리되는지 결과에서 확인합니다.
  5. PDF가 스캔 이미지라면 텍스트 인식 설정에서 인식 여부와 언어를 확인합니다. 한국어 표에 영문 코드가 섞이면 OCR 뒤 코드와 숫자를 특히 주의해서 대조합니다.
  6. 결과를 새 XLSX 파일로 저장합니다. 파일을 열어 시트별 표 범위, 마지막 행, 금액 합계, 식별코드의 앞자리 0을 검수한 뒤 닫았다가 다시 열어 저장 결과를 확인합니다.

Acrobat의 각 표·페이지별 워크시트 옵션은 긴 PDF를 분리해서 검토하기 좋고, 전체 문서 기준은 단일 표를 한 시트로 모을 때 편할 수 있습니다. 어떤 옵션을 골라도 페이지 제목·반복 머리글·중간 소계를 자동으로 정확히 제거한다고 가정하지 않습니다. 내보내기 결과가 한 워크시트에 합쳐져야 하는지 페이지별로 분리되어야 하는지 원본 업무의 기준을 먼저 정하세요.

스캔 PDF는 OCR을 적용한 뒤 표 추출을 시험합니다

이미지 PDF에서는 Excel이 표의 글자를 읽을 수 없습니다. Acrobat에서 복사본을 열고 모든 도구 → 스캔 및 OCR → 이 파일에서를 선택해 인식할 페이지 범위와 언어를 지정한 뒤 텍스트 인식을 실행합니다. 버전에 따라 메뉴 위치나 번역은 다를 수 있습니다. Adobe 도움말은 인식 후 의심되는 문자를 검토하고 교정하도록 안내합니다.

  1. 원본 PDF는 그대로 보관하고 OCR용 복사본을 만듭니다.
  2. 스캔 페이지 중 표가 있는 범위를 선택하고 문서의 주 언어를 지정합니다.
  3. OCR을 실행한 뒤 표의 코드·날짜·금액이 원본과 같은지 확대해 확인합니다. 0과 O, 1과 I, 쉼표와 소수점, 괄호와 음수 기호를 살핍니다.
  4. 저장한 OCR 사본에서 표 글자를 선택하고 검색할 수 있는지 확인합니다.
  5. Power Query나 Acrobat XLSX 변환을 다시 적용해 Navigator와 시트 구조를 비교합니다. 표가 계속 한 줄로 깨지면 Excel에서 모든 칸을 손으로 고치기보다 더 선명한 원본이나 원래 스프레드시트를 요청합니다.

OCR은 이미지를 보고 문자를 추정합니다. 검색과 복사가 가능해졌다고 숫자의 정확성까지 확인된 것은 아닙니다. 금액·세금·정산액·계정 식별번호는 원본 PDF와 문자 단위로 확인하고, 결과 파일에서 새로 계산한 합계도 원본의 금액과 비교하세요.

가상 PDF와 정답 Excel로 추출·검산을 연습합니다

아래 2쪽 PDF에는 일자·지점코드·지점·품목·수량·단가·금액이 있는 가상 거래 6건이 들어 있습니다. 첫 페이지에 3건, 둘째 페이지에 3건과 원본 총액이 있습니다. 먼저 Power Query나 Acrobat으로 PDF를 변환하고, 결과를 내려받을 Excel과 비교해 보세요. 파일에는 실제 인물·회사·거래 정보가 없습니다.

정답 통합 문서에서 원본 지점코드는 텍스트로 보존됩니다. PDF 변환 결과와 비교할 때 행 수는 6건, 총액은 132,000원입니다. 지점별 합계는 아산 63,500원, 일산 15,600원, 대전 52,900원입니다. 이 값 중 하나라도 다르면 총액만 억지로 맞추지 말고 누락 행, 중복 행, 줄바꿈으로 나뉜 셀, 페이지별 머리글 혼입부터 찾습니다.

Excel에서 행 수와 숫자·날짜·코드를 검산합니다

변환이 끝나면 표를 Excel 표로 정리한 뒤 원본과 결과를 각각 검사합니다. 표가 예쁘게 보이거나 전체 합계가 우연히 일치하는 것만으로는 누락과 중복을 알아낼 수 없습니다. 행 개수, 각 행 계산, 식별값, 기간 범위, 총액을 함께 확인합니다.

항목확인하는 방법가상 실습 기준
데이터 행 수머리글을 제외한 품목 열의 셀 개수 세기6건. PDF 페이지 머리글과 총액 행은 제외
행별 금액각 행에서 수량×단가와 금액 열 비교. 예: =IF(G2=E2*F2,"일치","확인")모든 행이 일치해야 함
금액 합계금액 열 합계 계산. 예: =SUM(G2:G7)132,000원
앞자리 0 코드코드를 텍스트로 두고 PDF 이미지와 비교00127·00131·00144·00149가 그대로 있어야 함
날짜 범위가장 이른·늦은 날짜와 원본 기간 제목 비교2026-09-03부터 2026-09-11까지
지점별 금액=SUMIFS(G:G,C:C,"아산")처럼 조건 합계를 계산아산 63,500원·일산 15,600원·대전 52,900원

위 예시의 열은 A 날짜, B 지점코드, C 지점, D 품목, E 수량, F 단가, G 금액입니다. 열 위치가 다른 통합 문서라면 수식을 그대로 복사하지 말고 해당 열에 맞게 고칩니다. 지점코드·주문번호 같은 식별자는 숫자로 계산하지 않으므로 텍스트 자료형을 사용합니다. 통화 금액은 숫자 값으로 두고 셀 표시 형식에 원화를 적용합니다.

  1. 행 수: 데이터 첫 행부터 마지막 데이터 행까지 세고, 머리글·소계·총계·쪽 제목이 포함되지 않았는지 PDF와 대조합니다.
  2. 행별 계산: 수량×단가가 금액과 다른 행을 찾아 원본의 숫자와 다시 비교합니다. 할인·세금·반올림이 있는 실제 업무라면 원본의 계산 규칙을 먼저 확인합니다.
  3. 누락과 중복: 앞·중간·끝 페이지에서 행을 표본으로 대조하고, 주문번호처럼 고유한 키가 있으면 중복 건수를 확인합니다.
  4. 자료형: 긴 코드는 앞자리 0이 남는지, 날짜가 텍스트와 날짜 값 중 어떤 상태인지, 쉼표가 천 단위 구분자인지 소수점인지 확인합니다.
  5. 합계: 원본 PDF의 총액과 Excel 합계를 비교합니다. 페이지별 소계가 데이터 행에 포함되었다면 중복 합산될 수 있으니 소계 행을 분리합니다.
  6. 저장: 검수한 결과를 새 이름으로 저장하고 다시 열어 수식·숫자 표시·시트 수가 남았는지 확인합니다.

CSV로 다시 전달한다면 Excel이 긴 코드를 숫자나 날짜로 바꾸지 않게 가져오기 단계를 따로 확인하세요. Excel·Google Sheets에서 CSV의 앞자리 0·날짜를 보존하는 방법은 PDF 표 추출 이후의 파일 형식 검수에 이어서 참고할 수 있습니다.

표가 깨지거나 숫자 합계가 맞지 않을 때

증상흔한 원인확인할 조치
한 행이 여러 행으로 쪼개짐PDF에서 줄바꿈된 문장을 Power Query가 별도 행으로 인식원본 페이지에서 같은 레코드인지 확인한 뒤에만 묶고, 품목·날짜·코드가 다른 데이터는 합치지 않음
표 머리글이 페이지마다 데이터로 들어옴각 페이지 표가 별도 항목으로 잡히고 헤더 반복이 포함됨반복 행을 식별해 제거하고 합친 뒤 데이터 열 이름을 확인
한글·숫자가 빈칸이나 다른 문자로 바뀜스캔 OCR 오류, 낮은 해상도, 기울기, 글꼴 문자 매핑더 선명한 원본을 요청하거나 OCR 의심 문자 검토. 금액과 코드 직접 대조
금액이 숫자가 아니라 텍스트원화 기호·공백·천 단위 쉼표·음수 괄호가 포함됨소수·천 단위 구분 기호를 원본과 맞추고 자료형 변경 전 표본 검산
지점코드 00127이 127로 변함숫자로 자동 변환되어 선행 0이 제거됨원본 코드가 식별자라면 텍스트로 가져오고 PDF 기준과 비교. 표시 형식만 덮어써 복구했다고 착각하지 않음
합계가 원본보다 큼중간 소계·페이지 총계·반복 행이 데이터에 포함숫자가 큰 행과 반복된 첫 열을 필터링해 원본의 표 구조와 대조
합계는 맞지만 일부 지점 금액이 다름행 간 값 이동이나 상쇄되는 누락·중복지점별 소계와 고유 코드·날짜를 함께 대조. 총합만 통과했다고 끝내지 않음

Power Query가 긴 문서에서 멈추거나 여러 페이지의 한 표를 지나치게 크게 잡으면 작은 페이지 범위를 나눠 처리하는 방법을 검토할 수 있습니다. Microsoft 문서의 StartPage, EndPage, MultiPageTables는 커넥터 옵션이며 일반 Navigator 화면에서 모든 이용자가 같은 이름의 스위치를 볼 수 있다는 뜻은 아닙니다. 필요하면 해당 M 함수를 편집할 수 있는 사용자가 적용하고, 페이지 범위를 빠짐없이 합쳤는지 전체 행 수와 합계로 확인합니다.

자주 묻는 질문

PDF를 Excel로 변환하면 표가 원본과 똑같이 나오나요?

보장되지 않습니다. PDF는 페이지 배치 형식이라 선 없는 표·병합 셀·여러 줄 설명에서 셀 위치를 잘못 나눌 수 있습니다. 변환본의 행 수·숫자·코드를 원본과 대조한 뒤 사용하세요.

무료 Acrobat Reader에서 XLSX 내보내기가 되나요?

Adobe Reader의 Export PDF로 Word·Excel·RTF 변환을 사용하려면 유료 Acrobat Export PDF 구독이 필요할 수 있습니다. 현재 계정에서 버튼이 보이지 않으면 라이선스와 제품 종류를 확인하고, 조직이 승인한 다른 경로를 이용하세요.

Mac Excel에서 PDF 가져오기 메뉴가 없어요.

Microsoft의 데이터 원본 지원표를 확인하세요. 플랫폼과 버전에 따라 제공되는 커넥터가 다릅니다. 로컬 PDF 항목이 없다면 Acrobat XLSX 내보내기 또는 승인된 Windows Excel 환경에서 처리합니다.

검색 가능한 PDF인데도 표가 엉망으로 변환됩니다.

검색 가능 여부는 글자가 텍스트인지 확인할 뿐, 셀의 행·열 구조를 보장하지 않습니다. Power Query Navigator에서 표 후보를 바꾸거나 Acrobat에서 페이지별 워크시트를 시험하고, 간단한 표는 직접 정리합니다.

Excel 합계만 원본과 같으면 검수가 끝난 건가요?

아닙니다. 같은 금액의 행이 빠지고 다른 행이 중복되어 전체 합계만 우연히 같을 수 있습니다. 데이터 행 수, 고유 코드, 행별 수량×단가, 날짜 범위, 지점별 소계를 함께 확인하세요.

Adobe와 Microsoft 공식 도움말

기능 경로와 제한은 위 Adobe·Microsoft 공식 도움말을 2026년 10월 10일 확인해 정리했습니다. 검색량이나 특정 글의 유입·수익 효과를 측정했다는 의미는 아닙니다.