구매 주문서 일괄 처리로 Excel 변환:한 번 설정으로 모든 공급업체 형식 지원

r/smallbusiness의 한 Reddit 사용자는 일상 업무를 이렇게 설명했습니다: 이메일에서 PO PDF 첨부 파일을 다운로드하고, 공급업체 이름, PO 번호, 품목, 수량, 가격을 Excel에 수동으로 입력 — 공급업체별, 주문별로 말이죠. "클라이언트마다 형식이 조금씩 다릅니다,"라고 그들은 적었습니다. "공급업체가 30개 이상입니다." 이는 도구 문제가 아닙니다. 형식 분산 문제입니다 — 그리고 템플릿 기반 추출은 문제를 해결どころか 더 악화시킵니다.

이 페이지는 일괄 Excel 워크플로 가이드입니다. 팀에 자동화된 PO 데이터 입력이 가치가 있는지 — 그리고 수동 대안의 실제 비용이 얼마인지 판단 중이라면, 구매 주문서 데이터 입력 자동화 가이드부터 시작하세요. 헤더 및 품목 데이터의 전체 필드별 추출 참조는 PO 데이터 추출 전체 가이드를 참조하세요.

AI로 PDF에서 구매 주문서 데이터를 하나의 Excel 시트로 일괄 추출

구매 주문서가 송장보다 일괄 처리하기 더 어려운 이유

송장은 비교적 쉽습니다. 대부분 일관된 구조를 갖고 있습니다. 상단에 판매자 정보, 중간에 품목 테이블, 하단에 합계가 있습니다. 구매 주문서 데이터 추출이 더 어려운 이유는 두 가지가 서로 맞물리기 때문입니다: 품목이 핵심 데이터이고, 공급업체마다 테이블 구조가 크게 다릅니다.

송장의 핵심 데이터 포인트는 보통 예측 가능한 위치에 있는 3~5개 필드입니다. 구매 주문서의 핵심 데이터는 목록입니다: 5개, 15개 또는 50개 행의 품목 코드, 설명, 수량, 단가, 행 합계. 각 행을 개별적으로 추출하고 올바른 PO 헤더와 매칭해야 합니다. 한 행을 놓치면 주문이 부족하고, 중복하면 지출이 이중 계산됩니다.

이제 여기에 PO를 보내는 공급업체 수를 곱해 보세요. 중간 규모 제조업체나 유통업체는 각각 다른 레이아웃을 가진 20~80개 고객으로부터 PO를 받을 수 있습니다. 한 고객은 품목 테이블을 1페이지에 넣고, 다른 고객은 6페이지에 걸쳐 매 페이지마다 열 헤더를 반복합니다. 또 다른 고객은 설명 앞에 수량을 넣고, 또 다른 고객은 뒤에 넣습니다. 어느 것도 "틀리지" 않습니다. 단지 다른 ERP 시스템이 PO PDF를 생성할 뿐입니다. 하지만 모든 형식 차이는 추출 도구가 처리해야 할 결정 사항입니다.

핵심 인사이트: 독립적인 업계 조사에 따르면 조달 리더의 57%가 여전히 구매 주문서에 수동 데이터 입력에 의존합니다. 병목 현상은 자동화 의지 부족이 아니라, 사용 가능한 자동화 도구가 데이터 입력 문제를 해결하기 전에 형식 문제를 해결하도록 요구하기 때문입니다. 다양한 공급업체 기반의 형식 문제를 해결하는 것 자체가 풀타임 작업입니다.

템플릿 함정: 공급업체당 하나의 템플릿은 확장되지 않는 이유

템플릿 기반 PO 추출 도구는 다음과 같이 작동합니다. 공급업체 A의 샘플 PO를 업로드하고 각 필드 주변에 경계 상자를 그리고 레이블을 지정한 후 템플릿을 저장합니다. 다음에 공급업체 A가 동일한 레이아웃의 PO를 보내면 도구가 이를 인식하고 데이터를 추출합니다. 공급업체 A가 PO 형식을 업데이트할 때까지는 잘 작동합니다. 그러면 템플릿이 깨지고 처음부터 다시 시작해야 합니다.

실제 실패 모드는 템플릿 증식입니다. 공급업체가 30개라면 템플릿도 30개가 필요합니다. 새 공급업체가 추가될 때마다 새 템플릿 설정 세션이 필요합니다. 보통 상자 그리기와 필드 레이블 지정에 10~15분이 걸립니다. 31번째 공급업체가 온보딩되면 누군가 하던 일을 멈추고 추출 도구를 열어 템플릿 31번을 만들어야 합니다. 그리고 기존 30개 공급업체 중 하나가 ERP나 PO 형식을 변경하면 추출이 조용히 실패할 때 알게 됩니다.

이것이 템플릿 함정입니다. 시간을 절약해 주려던 도구가 새로운 유형의 유지보수 작업을 만들어 낸 것입니다. "PO 데이터 수동 입력"을 "PO 템플릿 수동 유지보수"로 바꾼 셈입니다. r/AI_Agents에서 "이메일 PDF에서 PO, OC, 견적서를 읽고 수동으로 데이터를 입력하는" 일상을 설명한 Reddit 사용자에게 이 트레이드오프는 해결책이 아니라 제자리걸음입니다.

문제는 템플릿이 작동하지 않는다는 것이 아닙니다. 템플릿이 형식 안정성을 가정하지만 조달 현실은 형식 다양성이라는 것입니다. 각 템플릿은 특정 레이아웃을 인코딩합니다. 모든 공급업체의 레이아웃이 다를 때 템플릿 수는 공급업체 수에 비례하여 증가하며, 템플릿 라이브러리가 제거하려던 병목 현상이 됩니다.

열 이름 추출이 모든 PO 레이아웃을 처리하는 방식

여기 다른 접근 방식이 있습니다: 도구에 각 필드가 페이지에서 어디에 있는지 알려주는 대신, 각 필드가 무엇을 의미하는지 알려주는 것입니다. 이것이 열 이름 추출입니다 — 원하는 열을 정의하고, AI는 픽셀 좌표가 아닌 문서에서의 의미적 역할을 이해하여 각 값을 찾습니다.

입력한 열 이름은 출력 스프레드시트의 헤더가 됩니다. "PO 번호 / 공급업체 / SKU / 수량 / 단가 / 라인 합계"를 입력하면, 모든 공급업체와 모든 형식에 걸쳐 Excel에서 정확히 그 열이 생성됩니다. AI는 공급업체 A가 PO 번호를 오른쪽 상단에 두고 공급업체 B가 왼쪽 상단에 두는지 신경 쓰지 않습니다. PO 번호가 무엇인지 이해하여 값을 찾지, 어디에 있는지로 찾지 않습니다.

이것이 템플릿 OCR과 비전 AI의 차이입니다. 템플릿 OCR은 위치로 패턴을 매칭하고, 비전 AI는 사람처럼 문서를 읽습니다 — 맥락과 의미를 이해합니다. 열 이름 추출 엔진은 300개 라인 항목이 있는 15페이지 PO를 1분 안에 처리할 수 있습니다. 페이지 나눔, 반복 헤더, 중간 소계 — AI는 문서를 다시 연결해야 하는 분리된 PDF 페이지가 아닌 하나의 연속된 데이터 세트로 취급합니다.

JPG/PNG/PDF AI 추출

파일은 안전하게 처리되며 저장되지 않습니다.

일괄 처리 워크플로우: PDF 50개에서 스프레드시트 하나로

ImageToTable.ai의 일괄 PO 워크플로우는 한 가지 원칙을 중심으로 설계되었습니다: 도구가 문서에 적응하지, 문서가 도구에 적응하는 것이 아닙니다. 다음은 공급업체 PO 더미를 분석 준비가 된 단일 스프레드시트로 변환하는 전체 프로세스입니다.

1

출력 열을 정의하세요. 추출하려는 필드 이름을 입력하세요 — 예: "구매 주문 번호 / 발행일 / 공급업체 회사명 / 품목 코드 / 품목 설명 / 주문 수량 / 단가 / 라인 합계 / 주문 총액." 이 필드들이 스프레드시트의 열 머리글이 됩니다. 한 번 설정하면 동일한 열 목록이 모든 공급업체에 적용됩니다.

2

모든 PO 파일을 한 번에 업로드하세요. 20개, 50개 또는 100개의 PO PDF를 단일 배치로 끌어다 놓으세요. 이 도구는 스캔된 종이 PO, 이메일 첨부 PDF, ERP 생성 출력 등 공급업체가 보내는 모든 형식을 허용합니다.

3

AI가 각 문서를 병렬로 처리합니다. 각 PO는 열 정의와 대조됩니다. AI는 문서를 맥락적으로 읽어 PO 번호, 공급업체 이름, 모든 라인 항목 행을 페이지 내 위치와 관계없이 추출합니다.

4

병합된 스프레드시트를 검토하고 내보내세요. 추출된 모든 데이터가 단일 테이블에 표시됩니다. 각 행은 한 PO의 라인 항목 하나를 나타내며, PO 헤더 필드가 해당 PO의 모든 행에 포함됩니다. XLSX로 내보내기 — 서식 지정, 정렬, ERP 가져오기 또는 지출 분석에 바로 사용할 수 있습니다.

처리 시간은 형식 복잡성이 아닌 문서 수에 비례합니다. 단일 페이지 PO는 몇 초 안에 처리됩니다. 50개의 단일 페이지 PO 배치는 몇 분 안에 완료됩니다. AI는 익숙하지 않은 레이아웃을 만나도 속도가 느려지지 않습니다 — 이것이 위치 기반 추출보다 의미 기반 추출을 사용하는 핵심 이유입니다.

팀이 Excel 대신 Google Sheets를 사용하거나, 배치 완료 시 계속 업데이트되는 라이브 대시보드를 원한다면, 동일한 일괄 워크플로우가 결과를 Sheets 기반 대시보드로 직접 전달할 수 있습니다. 구매 주문을 Google Sheets 대시보드로 일괄 처리하는 가이드를 참조하세요.

월 50 PO 규모에서 일본 조달 관행을 적용한 실제 예시는 일본 구매 주문을 조달 대시보드로 일괄 처리하는 가이드를 참조하세요.

반복되는 열 머리글이 있는 다중 페이지 PO는 어떨까요? AI는 이를 하나의 연속 테이블로 인식합니다. 300개 라인 항목이 있는 15페이지 PO는 출력에서 300개의 행을 생성하며, 수동으로 이어 붙여야 하는 15개의 개별 테이블이 아닙니다.

추출 문제를 해결한 후에도 그 아래에 숨어 있는 물류 문제가 있습니다: PO 파일을 시스템에 가져오는 것입니다. 현재 워크플로우가 "이메일 확인 → PDF 첨부 파일 다운로드 → 폴더에 저장 → 추출 도구에 업로드"라면, 추출은 자동화되었지만 수집은 그렇지 않습니다.

수집 링크는 이 격차를 해소하는 기능입니다. 고유한 URL을 생성하여 공급업체와 공유합니다. 공급업체는 링크를 열고 짧은 확인 코드를 입력한 후 PO 파일을 직접 업로드합니다. 파일은 처리 대기열에 도착합니다 — 이메일, 다운로드, 폴더가 필요 없습니다. 공급업체는 계정이 필요 없고, 로그인할 필요도 없으며, 아무것도 설치할 필요가 없습니다.

수십 개 공급업체의 PO를 관리하는 팀에게 이는 프로세스에서 가장 비효율적인 부분, 즉 흩어진 이메일 첨부 파일을 수집하는 중간 단계를 제거합니다. "공급업체 이메일 30개 확인 → PDF 30개 다운로드 → 정리 → 업로드" 대신 "공급업체 업로드 → PO가 대기열에 표시 → 일괄 처리 → 내보내기" 흐름이 됩니다.

어떤 PO 형식에서 작동하나요?

열 이름 추출은 레이아웃이나 생성 방법에 의존하지 않으므로 모든 PO 형식에서 작동합니다:

  • ERP 생성 PDF — SAP, Oracle, NetSuite, Microsoft Dynamics, QuickBooks. 각 ERP는 PO를 다르게 출력합니다. AI는 상관하지 않습니다.
  • 스캔한 종이 PO — 여전히 종이로 보내는 공급업체의 경우, 휴대폰 사진이나 스캐너 PDF로 충분합니다. AI는 스캔 품질과 관계없이 텍스트를 읽습니다.
  • 이메일 본문 PO — 일부 소규모 공급업체는 이메일 본문에 PO를 일반 텍스트로 보냅니다. 스크린샷을 찍어 업로드하면 동일한 열 이름 추출이 적용됩니다.
  • 일본어 PO — 일본 공급업체의 発注書는 동일한 형식 다양성 패턴을 따르지만 일본어 필드 규칙(発注番号, 納期, 支払条件)을 사용합니다. 구체적인 열 스키마, 소비세 분류 및 지불 조건 규칙은 일본어 구매 주문 데이터 추출 가이드를 참조하세요.
  • 다중 형식 혼합 배치 — 하나의 배치에 ERP PDF, 스캔, 스크린샷이 포함될 수 있습니다. AI는 각각을 독립적으로 처리하지만 동일한 통합 스프레드시트로 출력합니다.

실용적 한계: 최상의 결과를 위해 문서는 합리적으로 읽을 수 있어야 합니다 — 스캔의 경우 150 DPI 이상. 심하게 기울어진 사진이나 배경 패턴이 많은 문서는 부분적인 결과를 생성할 수 있습니다. 깨끗한 인쇄 PO 테이블에서 라인 항목에 대한 AI의 정확도는 일반적으로 90%를 초과하지만, 손으로 쓴 주석이나 빽빽한 작은 글씨 테이블에서는 떨어집니다.

자주 묻는 질문

여러 페이지에 걸쳐 있는 품목이 포함된 구매 주문서도 처리할 수 있나요?

네. AI는 여러 페이지로 구성된 구매 주문서를 하나의 연속된 문서로 처리합니다. 15페이지 분량의 구매 주문서에 300개의 품목이 있으면 300개의 행이 생성되며, 구매 주문서 헤더 필드가 모든 행에 포함됩니다. 각 페이지에 반복되는 열 헤더는 헤더로 인식되어 출력에서 제외됩니다 — 중복이나 조각 없이 처리됩니다.

공급업체가 동일한 필드에 대해 다른 이름을 사용하면 어떻게 하나요 — 예: "Item No." vs. "SKU" vs. "Product Code"?

AI는 의미적으로 동일한 용어를 매핑합니다. 열 이름을 "Item Code"로 지정하면 문서 내에서 "Item No.," "SKU," "Product Code," 또는 "Part Number"로 표시된 필드를 찾아 Item Code 열에 매핑합니다. 모든 동의어를 나열할 필요는 없습니다 — AI가 이들이 동일한 개념을 가리킨다는 것을 이해합니다.

공급업체별로 설정해야 할 것이 있나요?

아니요. 한 번 정의한 열 목록은 모든 공급업체에 적용됩니다. 템플릿 작성, 공급업체별 구성, 학습 단계가 필요 없습니다. 열을 입력하고, 파일을 업로드하고, 스프레드시트를 받으세요. 이것이 열 이름 추출과 템플릿 기반 도구의 핵심 차이입니다.

구매 주문서에 필드가 누락된 경우 — 예를 들어 일부 공급업체가 결제 조건을 포함하지 않는 경우는 어떻게 되나요?

해당 구매 주문서의 해당 필드 셀은 출력에서 비어 있는 상태로 남습니다. 스프레드시트 구조는 모든 행에서 일관되게 유지되며, 누락된 필드는 빈 셀로 표시됩니다. 오류, 수동 수정, 템플릿 불일치 경고가 없습니다.

ERP 형식으로 직접 내보낼 수 있나요?

네 — 열 이름을 ERP 가져오기 형식에 맞게 구성하면 됩니다. 추출 설정 시 ERP의 정확한 열 헤더를 사용하면 XLSX 출력을 바로 가져올 수 있습니다. 날짜 형식과 숫자 형식은 ERP 요구 사항에 맞게 추출 지침에서 지정할 수 있습니다.

밀집된 구매 주문서 테이블의 품목 추출 정확도는 어느 정도인가요?

깨끗하게 인쇄된 구매 주문서 테이블의 경우 품목 추출 정확도는 일반적으로 90%를 초과합니다. 주요 정확도 저하 요인은 다음과 같습니다: 매우 작은 글꼴, 테이블 뒤의 진한 배경 패턴, 인쇄된 필드 위의 손글씨 메모, 심하게 기울어진 스캔. FAQ 답변은 "항상 99%"가 아니라 "일반적인 인쇄 구매 주문서의 경우 90%+, 가장자리 사례의 경우 그보다 낮음"입니다. 이는 공정한 절충입니다: 가끔 수동 점검이 필요한 90%+ 자동화 vs. 피로 오류가 보장된 100% 수동 작업.

주문 확인서(OC)와 판매 오더에도 적용되나요?

네, 동일한 열 이름 추출 방식이 모든 구조화된 문서 유형에 적용됩니다. 주문 확인서의 경우 "주문 번호 / 확인 날짜 / 확정 납품 날짜 / 확정 수량 / 단가"와 같은 열을 지정하세요. 판매 오더의 경우 "판매 오더 번호 / 고객 PO 번호 / 배송 주소 / 제품 코드 / 주문 수량"을 지정하세요. 메커니즘은 동일합니다 — AI에 원하는 것을 알려주면 문서에서 찾아냅니다.

대량 일괄 추출 대신 특정 헤더 필드와 선택된 라인 항목이 필요한 개별 PO 처리의 경우, 구매 오더에서 필요한 필드만 추출하는 방법을 참조하세요.

구매 오더 일괄 처리의 경우, 전용 변환기가 모든 공급업체 형식의 대량 PO 추출을 처리하여 하나의 통합 스프레드시트로 제공합니다.

📮 contact email: [email protected]