PDF to Google Sheets: 파일 링크가 아닌 행으로 데이터 가져오기
PDF를 Google Sheets에 다시 입력하는 데 페이지당 약 3분이 소요되며, Google Docs에서 붙여넣기하면 열이 하나로 깨집니다. 대신 열 이름을 지정하면 데이터가 행으로, 숫자는 숫자로 페이지당 5~10초 안에 입력됩니다.
페이지당 5~10초 · 인쇄 텍스트 99% 정확도 · 레코드당 한 행 · 스캔 PDF 포함
데이터가 시트에 도착했을 때의 모습
PDF to Google Sheets 워크플로는 결과물을 바로 사용할 수 있을 때만 가치가 있습니다. 이름이 지정된 열, 레코드당 한 행, 합산할 수 있는 숫자로 저장된 금액이 필요합니다. 필요한 열 이름을 입력하면 AI가 문서에서 각 값을 의미를 이해하여 찾아내므로, 한 공급업체의 인보이스와 다른 업체의 명세서가 단일 배치에서 동일한 헤더 아래에 정리됩니다.
이 메커니즘은 Custom Column Extraction입니다. 열 이름을 입력하면 AI가 값을 채워 넣습니다. 혼합 배치에는 File Name을 추가하는 것이 좋습니다. 모든 데이터가 통합된 후 각 행이 어떤 PDF에서 왔는지 알 수 있기 때문입니다. 날짜, 금액, 참조 번호는 추출되는 즉시 정리되고 형식이 지정되므로 Total Amount 1,240.00은 통화 기호가 붙은 텍스트가 아닌 숫자로 처리됩니다.
PDF를 Google Sheets로 가져오는 것은 두 가지 다른 의미를 가집니다
하나는 셀에 있는 파일 아이콘이나 Drive 링크를 의미합니다. 다른 하나는 PDF를 Google Sheets로 변환하려 할 때 거의 모든 사람이 실제로 원하는 것입니다: 문서의 데이터가 선택한 열 아래 시트의 행이 되는 것입니다. 이 둘 사이의 간격은 대부분의 시도가 중단되는 지점이며, 그 이유는 노력이 아니라 구조적입니다.
복사-붙여넣기는 그리드를 파괴합니다. 그리드가 저장된 적이 없기 때문입니다. PDF는 행과 열이 아닌 개별 위치의 문자만 유지하므로, Sheets에 붙여넣으면 하나의 병합된 열이나 뒤죽박죽이 됩니다. 월간 명세서를 자동화하는 r/googlesheets 사용자는 이렇게 말했습니다. “시트에 은행 명세서 텍스트를 복사하여 붙여넣는 것은 완전히 체계적이지 못합니다.” 같은 사용자는 텍스트를 수동으로 열로 분리하는 것은 "시간이 너무 많이 걸린다"고 지적했습니다.
파일 변환기는 PDF의 복제본을 제공할 뿐, 사용할 수 있는 데이터는 제공하지 않습니다. Excel로 변환하는 방법은 페이지를 셀에 다시 그리려고 시도합니다. 로고, 바닥글, 병합된 셀, 다음 페이지 머리글까지 모두 따라옵니다. Sheets에 들어가는 것은 문서처럼 보이며, 매번 첫 SUM을 실행하기 전에 정리 작업, 열 다시 매핑, 불필요한 행 삭제가 필요합니다.
다운로드-가져오기 사이클은 영원히 반복됩니다. 변환하고, 다운로드하고, Sheets 열고, 가져온 후, 매핑을 다시 확인하고, 다음 달에 다시 반복합니다. 각 단계는 열 순서가 어긋나거나 파일이 잘못된 탭에 저장될 수 있는 지점이며, 실제 작업 진행에는 전혀 도움이 되지 않습니다. 문제는 행이 아니라 행을 올바르게 정리하는 것이었습니다.
열 이름을 지정하면 AI가 의미에 따라 값을 채웁니다. Custom Column Extraction은 각 문서를 의미적으로 읽습니다. "Total Due", "Amount Payable", "Grand Total"은 모두 Total Amount라는 열에 들어갑니다. 공급업체별 템플릿도, 영역 지정도 필요 없으며, 공급업체가 레이아웃을 변경해도 사용자 측에서는 아무것도 바뀌지 않습니다.
모든 문서가 올바른 유형의 한 행이 됩니다. 출력은 페이지 복제본이 아닌 테이블입니다. 레코드당 한 행, 열 이름은 헤더로, 날짜는 날짜로, 금액은 숫자로 표시됩니다. 정렬, 필터링, 피벗 테이블, SUMIF 수식이 추출 중 정리 과정을 거친 결과에 즉시 적용됩니다.
부가 기능이 마지막 단계를 완전히 제거합니다. Google Sheets 사이드바 부가 기능이 PDF를 업로드하고, 추출한 다음, 기존 데이터와 수식 아래의 활성 시트에 행을 추가합니다. 내보낸 파일을 다운로드하거나, 가져오기 대화상자를 열거나, 매핑할 필요가 없습니다. 기존 헤더는 그대로 유지됩니다.
공급업체 PDF에서 선택한 헤더 아래 행으로, 세 단계로
받은 그대로의 PDF를 업로드하세요
월말에 인보이스를 통합하는 경우 받은 편지함이나 다운로드 폴더에서 PDF를 바로 끌어다 놓으세요. 디지털 내보내기, 스캔본, 혼합 레이아웃, 다중 페이지 명세서 등이 포함됩니다. 배치에서 모두 혼합할 수 있으며 비밀번호로 보호된 PDF도 지원됩니다. 사전 정리 단계, 이름 변경, 이미지 변환 과정이 필요 없습니다.
시트에 원하는 열 이름을 입력하세요
목록을 한 번만 입력하세요: Invoice Number | Vendor | Date | Total Amount | Due Date. 이름을 추적기가 이미 사용하는 헤더와 일치시키면 나중에 다시 매핑할 필요가 없습니다. 작업을 미리 정렬하고 싶으신가요? Category (options: Software/Travel/Office/Other) 같은 추론 열을 추가하면 AI가 같은 패스에서 각 행에 태그를 지정합니다.
PDF당 한 행씩, 하나의 테이블로
처리는 페이지당 5~10초가 소요되며, 배치 결과는 단일 테이블로 통합되어 파일 → 가져오기로 바로 사용하거나 XLSX 또는 CSV로 직접 다운로드할 수 있습니다:
| 송장 번호 | 공급업체 | 날짜 | 총 금액 |
|---|---|---|---|
| INV-2041 | Beacon Office Supply | 2026-08-03 | 1240.00 |
| 88213 | Northline Logistics | 2026-08-11 | 317.55 |
두 개의 PDF, 두 개의 다른 레이아웃, 하나의 일관된 테이블. 가져오기를 건너뛰고 싶다면, Extract to Google Sheets 애드온 페이지에서 이 행들을 열려 있는 시트에 바로 작성하는 사이드바와 동일한 목적지로 가는 애드온 경로를 확인하세요.
PDF to Google Sheets 추출이 적합한 경우와 한계
추출 기능은 PDF 문제의 데이터 측면을 잘 처리하며, 워크플로우에 적용하기 전에 알아두어야 할 두 가지 경계가 있습니다.
안정적으로 처리하는 경우
인쇄된 표와 필드가 있는 디지털 PDF. 인보이스, 구매 주문서, 은행 및 신용카드 명세서는 공급업체별 템플릿 없이 인쇄된 텍스트에서 최대 99% 정확도로 추출됩니다.
혼합 배치를 하나의 테이블로. 서로 다른 공급업체, 서로 다른 레이아웃, 서로 다른 페이지 수의 문서를 한 번의 실행으로 처리하며, 하나의 열 목록으로 통합하고 파일 이름으로 행을 추적할 수 있습니다.
비밀번호 보호 및 스캔된 PDF. 암호화된 파일은 사전에 저장한 비밀번호로 잠금 해제되며, 스캔된 페이지는 별도의 OCR 파이프라인 없이 동일한 비전 모델로 처리됩니다.
알아두어야 할 한계
데이터를 추출할 뿐, 파일을 삽입하지 않습니다. 이 워크플로우의 어떤 도구도 PDF를 셀에 링크나 아이콘으로 첨부하지 않으며, 이는 Google Drive의 작업으로 남아 있습니다. 파일이 시트에 들어가는 것이 목표라면 추출은 설계상 잘못된 범주입니다.
품질이 낮은 스캔은 정확도를 떨어뜨립니다. 바랜 영수증, 기울어진 휴대폰 사진, 200dpi 미만의 스캔은 모든 추출 엔진의 필드 수준 정확도를 낮춥니다. 평평하고 똑바르게 200dpi 이상으로 스캔한 후 첫 번째 배치를 검토하세요.
여러 페이지에 걸친 문서는 병합 규칙이 필요합니다. 5페이지에 걸친 명세서는 기본적으로 5개의 페이지 행으로 추출됩니다. 템플릿에서 그룹화를 구성하면 다중 페이지 병합이 이를 하나의 레코드로 다시 접어줍니다.
자주 묻는 질문
PDF를 Google Sheets에 어떻게 삽입하나요?
Google Sheets에 PDF를 삽입하는 방법에 대한 검색은 보통 두 가지를 의미합니다. 파일 자체를 링크나 아이콘으로 셀에 첨부하려면 PDF를 Google Drive에 저장하고 셀에 링크를 삽입하면 됩니다. Sheets에는 파일 첨부 기능이 기본 제공되지 않으며, 어떤 추출 도구도 이를 변경하지 않습니다. PDF의 데이터를 행과 열로 시트에 넣으려는 경우는 데이터 추출이며, 이 페이지에서 다루는 내용입니다. 필요한 열 이름을 지정하면 값이 셀의 파일이 아닌 사용 가능한 데이터로 시트에 입력됩니다.
PDF 표를 Google Sheets에 붙여넣으면 왜 깨지나요?
PDF는 행과 열을 저장하지 않습니다. 페이지에서 개별적으로 배치된 문자만 저장하며, 보이는 표는 우연히 정렬된 문자일 뿐입니다. PDF 뷰어나 Google Docs에서 복사하면 클립보드에 표 구조 없는 단순한 텍스트 흐름이 전달되어, Sheets는 이를 한 열로 쏟거나 셀을 병합합니다. 위치를 기반으로 격자를 재구성하는 도구는 병합된 셀과 다중 페이지 표에서 자주 실패합니다. 열 이름 추출 방식은 이 문제를 우회합니다. 다른 열 사이의 열 사이의 AI가 각 값의 의미를 읽고 지정한 열에 배치하므로, 원래 격자가 유지되지 않아도 됩니다.
무료로 PDF를 Google Sheets로 변환할 수 있나요?
네, 시작을 위해 가능합니다. 계정 없이 PDF를 업로드하고 첫 번째 변환을 실행할 수 있으며, 무료 요금제는 가끔의 단일 파일 변환을 지원합니다. 월별 인보이스나 명세서 배치와 같은 반복 작업은 파일당이 아닌 월별로 청구되는 유료 요금제로 진행됩니다. PDF를 Google Sheets로 무료로 변환을 시도할 수 있는 무료 경로는 이 페이지의 데모입니다. PDF를 드롭하고 몇 가지 열 이름을 입력한 다음, 작업 흐름에 맞는지 결정하기 전에 추출된 표를 확인하세요.
스캔된 PDF에서도 작동하나요, 아니면 별도의 OCR 소프트웨어가 필요한가요?
스캔된 PDF는 별도의 OCR 단계 없이 작동합니다. 비전 모델이 페이지를 이미지로 읽고 디지털 PDF와 동일한 과정에서 값을 추출하므로, 스캔된 인보이스, 명세서, 양식도 동일한 업로드 및 열 이름 지정 흐름을 거칩니다. 켜야 할 Google Sheets OCR 기능이 없기 때문에 Google Docs를 경유하면 단일 평면 열의 텍스트만 생성되며, OCR을 Google Sheets에 별도 단계로 연결하는 애드온이 존재하는 이유이기도 합니다. 200dpi 이상의 깨끗한 스캔은 안정적으로 추출되지만, 흐리거나 기울어졌거나 저해상도 스캔은 정확도를 떨어뜨리므로 첫 번째 배치에서 몇 개의 행을 점검해 보시기 바랍니다.
PDF에 실제로 인쇄되지 않은 열도 추출로 채울 수 있나요?
네, 두 가지 방법이 있습니다. 추론 열을 사용하면 문서에 없는 필드를 정의할 수 있으며, AI가 각 문서의 내용을 판단하여 채우므로 추출과 분류가 한 번에 이루어집니다. 계산 열은 추출 중에 산술 연산을 수행합니다. 예를 들어 세액을 합계에서 소계를 뺀 값으로 정의하거나, 품목 합계를 수량 곱하기 단가로 정의할 수 있으므로, 결과가 셀에 바로 도착하며 이후에 직접 수식을 작성할 필요가 없습니다.