한국 문서 추출 가격
2026년 정부 vs AI 도구 비교
한국에서 문서 추출 도구를 검색하면 세 가지 가격 체계가 나오지만, 같은 비교 페이지에서 보기는 어렵습니다. 첫째는 무료입니다. 국세청의 홈택스 포털은 전자 세금계산서를 무료로 처리하지만, 시스템을 통해 발행된 세금계산서만 읽을 수 있다는 치명적인 한계가 있습니다. 둘째는 한국 국내 소프트웨어 시장입니다. 더존, 이카운트 같은 ERP 플랫폼, 자비스 같은 AI 회계 도구, 네이버 클로바 OCR 같은 독립형 OCR 서비스는 월 3만 원에서 5만 원 이상입니다. 셋째는 한국어 검색 결과에서는 거의 보이지 않는 가격 체계입니다. 달러 기준 AI 추출 도구는 월 9달러부터 시작합니다. 한국어로 검색하는 중소기업은 이 도구를 찾지 못할 것입니다. 이 비교는 바로 그 격차를 해소하기 위해 만들어졌습니다.
핵심 요약
- 한국에서 문서 추출 도구를 검색하면 세 가지 가격 체계가 나오지만, 같은 페이지에서 보기는 어렵습니다: 무료 정부 홈택스, 월 3만 원 이상 국내 ERP 도구, 그리고 대부분의 한국어 검색자가 보지 못하는 월 9달러 달러 기반 가격 체계입니다.
- 한국어 검색 결과에 나타나는 도구들은 공급업체의 PDF를 읽을 수 있는지보다는 얼마나 많은 ERP 모듈을 번들로 제공하는지로 경쟁합니다. 반면 ImageToTable.ai는 월 9달러로 정확히 한 가지 작업을 수행하며, 추출 단계를 회계 스택과 독립적으로 만듭니다.
- 기능 목록을 비교하는 대신 한 가지 질문을 던져보세요: 이 도구는 레이아웃과 관계없이 각 필드의 의미를 이해하여 PDF를 읽는가, 아니면 국세청 시스템의 구조화된 전자 세금계산서만 처리할 수 있는가?
세 가지 가격 트랙, 세 가지 다른 구매자 가정
중소벤처기업부의 2022년 조사에 따르면, 한국에는 약 800만 개의 중소기업이 있으며, 1,896만 명을 고용하고 총 3,309조 원의 매출을 올리고 있습니다. 이 기업들은 엄청난 양의 문서를 처리하며, 전자세금계산서 의무화로 인해 한국은 세계에서 가장 디지털화된 문서 환경 중 하나가 되었습니다.
하지만 '가장 디지털화되었다'는 것이 '중소기업 수준에서 완전히 자동화되었다'는 의미는 아닙니다. 인프라와 일상 업무 사이의 간극이 바로 데이터 추출 가격 문제가 존재하는 곳입니다. 그리고 그 답은 어느 트랙을 평가하느냐에 따라 완전히 달라집니다.
| 트랙 | 가격대 | 대상 | 실제 추출 대상 | 필요한 연동 |
|---|---|---|---|---|
| 트랙 1: 정부 | 무료 | 한국 내 모든 사업자 | 전자세금계산서만 해당 — 전자 발행, 국세청 전송 | 없음 또는 ERP API |
| 트랙 2: 국내 상용 | 월 3만~5만 원 이상 + 초기 비용 | ERP 구매 기업, 대기업, 회계 법인 | 영수증 및 정형화된 청구서 형식; 레이아웃 변형이 제한적~보통 수준 | 보통 ERP/회계 패키지에 포함 |
| 트랙 3: 달러 기반 AI | 월 $9~$59 (₩13,050~₩85,550) | 전 세계 셀프서비스 소상공인 | 모든 문서 형식 — PDF, 스캔, 사진, 스크린샷 — 의미 기반 필드 매칭 | 없음 — Excel/CSV로 내보내기 가능 |
세 트랙은 동일한 기준으로 경쟁하지 않습니다. 트랙 1은 무료이지만 범위가 좁습니다. 트랙 2는 모든 기능을 갖추고 있지만, 전체 ERP를 구매하거나 사용자당 라이선스를 정당화할 만한 충분한 볼륨이 있는 구매자를 대상으로 가격이 책정되었습니다. 트랙 3은 문서에서 데이터를 추출하는 한 가지 목적에 특화되어 있으며, 스프레드시트만 있으면 되는 셀프서비스 구매자를 대상으로 가격이 책정되었습니다. 한국 시장의 가격 계층 구조로 인해 트랙 2가 한국어로 검색하는 사람들의 기본값이 되며, 트랙 3은 그 존재를 알고 있어야 사용할 수 있습니다.
트랙 1: 홈택스 — 무료, 정부 구축, 엄격한 제한
홈택스와 모바일 버전인 손택스는 한국 문서 데이터 논의의 기본 출발점입니다. 이 시스템은 전자세금계산서 발행, 국세청(NTS) 전송, 수신 세금계산서 조회를 모두 무료로 처리합니다. 국세청(NTS) 시스템을 통해 전자세금계산서를 발행하는 등록된 공급업체만 거래하는 중소기업에게 홈택스는 세금계산서 데이터 워크플로 전체를 커버합니다. 데이터는 이미 구조화되어 있고 검증 가능하며, 정부 포털이나 ERP 연동을 통해 접근할 수 있습니다.
한계는 범위에 있습니다. 홈택스는 세무 행정 플랫폼, 즉 전자문서의 등록 및 전송 시스템으로 설계되었으며, 범용 문서 추출 도구가 아닙니다. PDF를 처리하지 않습니다. 스캔본을 읽지 않습니다. 사진에서 필드를 추출하지 않습니다. 종이 세금계산서를 발행하거나 PDF를 이메일로 보내는 공급업체는 시스템에서 확인할 수 없습니다. 중국이나 일본 공급업체의 해외 공급업체 청구서도 확인할 수 없습니다. 영수증, 은행 거래 명세서, 납품서, 발주서 등은 홈택스에 존재하지 않습니다. 애초에 그렇게 설계되지 않았기 때문입니다.
완전히 규정을 준수하는 공급업체로부터 전자세금계산서만 처리하는 기업에게 홈택스는 사실상 완벽한 솔루션입니다. 여기에 회계를 위한 ERP를 더하면 됩니다. 그러나 등록 및 미등록 공급업체, 국내외 파트너, 전자 및 종이 형식이 혼재된 80~200개의 공급업체 관계를 가진 일반적인 중소기업의 경우, 홈택스는 유입 문서량의 약 60%만을 커버합니다. 나머지 40%는 트랙 2 또는 트랙 3 영역에 해당합니다.
트랙 2: 국내 상용 도구 — 월 3만 원에서 5만 원 이상으로 얻을 수 있는 것
한국 상용 문서 소프트웨어 환경은 세 가지 계층으로 나뉘며, 추출 기능은 계층 간에 크게 다릅니다.
계층 1 — 기본 OCR이 포함된 회계/ERP 제품군. 월 4만 원의 이카운트는 8만 개 이상의 기업에 회계, 재고, 급여, 그룹웨어 등 전체 ERP 스택을 무제한 사용자로 제공합니다. 월 3만 3천 원의 자비스는 은행 거래 내역 집계 및 4대보험 급여 연동을 갖춘 AI 기반 회계 프로그램을 제공합니다. 두 서비스 모두 짧고 표준화된 영수증에 최적화된 영수증 수준의 OCR을 포함합니다. 공급업체마다 레이아웃이 바뀌는 다중 필드 공급업체 청구서에 필요한 의미론적 문서 추출 기능은 포함하지 않습니다.
계층 2 — 영수증 OCR이 포함된 지출 관리 플랫폼. 비즈플레이는 17개 국내 카드사 네트워크에 걸쳐 법인카드 지출 처리를 자동화하며, 사용자당 가격을 적용합니다. 영수증 이미지를 수집하고 카드 거래 내역과 매칭하는 데 강점이 있습니다. 이는 직원 지출 워크플로에 실질적인 효율성 향상을 가져옵니다. 그러나 공급업체 세금계산서, 발주서 또는 지출 영수증 사용 사례를 넘어서는 모든 문서 유형에서 구조화된 데이터를 추출하도록 설계되지는 않았습니다.
계층 3 — 독립형 OCR 엔진. 네이버 클로바 OCR은 한국어 정확도 97~99%로 선두를 달리며, 사용량 기준 페이지당 약 50원에 책정되어 있습니다. NHN Cloud OCR과 카카오 엔터프라이즈 OCR도 유사한 페이지당 가격에 플랫폼별 강점을 제공합니다. 이들은 진정한 추출 도구입니다. 한국어 문서를 읽고 구조화된 데이터를 출력합니다. 그러나 이들은 "회계 프로그램"이나 "ERP"보다는 "OCR" 또는 "문서 추출"을 구체적으로 검색하는 구매자라는 좁은 시장 세그먼트를 차지합니다.
기업용으로 보면 삼성SDS 브리티 웍스(Brity Works)는 문서 AI로 정형 문서 정확도 94~96%를 제공하고 RPA도 연동되지만, 가격이 수천만 원대에 구축 기간도 수개월이 걸립니다. 한국딥러닝은 VLM 기반 DEEP OCR+를 온프레미스로 제공하며 기업용 보안을 갖췄습니다. 해외 VLM 도구의 진정한 한국 대안이지만, 규제 준수가 필요한 기업 구매자를 대상으로 하며 중소기업(SME)용은 아닙니다.
세 계층에 공통된 문제는 데이터를 잘 추출해주는 도구가 필요하지 않은 ERP에 묶여 있거나, 페이지당 과금이 중소기업 규모에서는 부담스럽거나, 월 구독료보다 구축 비용이 훨씬 큰 엔터프라이즈급으로 포지셔닝되어 있다는 점입니다. 이미 회계 시스템을 갖추고 문서에서 스프레드시트로 데이터만 추출하면 되는 중소기업에는 이 중 어느 트랙도 정확히 맞지 않습니다. 구독형과 페이지당 과금 도구 비교를 보면 볼륨에 따라 손익분기점이 다릅니다.
트랙 3: 달러 결제 AI 추출 — 한국에서는 아무도 검색하지 않는 트랙
1달러에 1,450원인 상황에서 월 9달러짜리 추출 플랜은 13,050원입니다. 한국 도구가 비싸서가 아니라, 다른 구매자를 대상으로 가격이 책정되어 있기 때문입니다.
ImageToTable.ai는 세 번째 트랙을 대표합니다. 달러 기준 셀프서비스 추출 도구로, PDF를 업로드해서 스프레드시트를 받고 싶은 소상공인을 대상으로 합니다. 설치할 ERP도, 구축 프로젝트도, 사용자당 라이선스도 없습니다. 월 9달러 개인 플랜은 개인 사업자의 월간 문서량을, 월 19달러 프로 플랜은 일반 중소기업의 월간 문서 처리량을 커버합니다.
기술적 접근 방식이 한국 국내 OCR과 결정적으로 다른 점은 위치 기반 OCR 대신 의미 기반 AI 추출을 사용한다는 것입니다. 클로바 OCR 같은 전통적인 OCR 엔진은 페이지에서 텍스트를 읽어 문자열로 반환하며, 사용자가 그 문자열을 파싱해서 필드 값을 찾아야 합니다. 의미 기반 추출은 사람이 문서를 읽는 방식대로 작동합니다. '사업자등록번호'라는 문자 옆에 XXX-XX-XXXXX 패턴의 10자리 숫자가 있으면, 페이지 내 위치와 관계없이 사업자등록번호로 이해합니다. 즉 공급업체별 템플릿 설정이 필요 없습니다. 컬럼을 한 번 정의하면 AI가 모든 문서 형식에서 값을 매칭합니다. 40개 공급업체가 40가지 다른 인보이스 양식을 사용하는 중소기업에게 이는 자동화와 포기 사이의 차이입니다.
파일은 안전하게 처리되며 저장되지 않습니다.
세금계산서의 경우, 세금계산서 추출 경제성은 세 번째 방식을 훨씬 더 유리하게 만듭니다. 홈택스가 전자세금계산서를 무료로 처리하기 때문에, 추출 도구의 가치는 정부 시스템이 다루지 못하는 PDF와 스캔 문서에 집중됩니다. 그리고 세금계산서 외의 문서 유형에 대해서는 홈택스가 전혀 제공하는 바가 없습니다. 이러한 문서들은 전적으로 Track 2 또는 Track 3 영역에 속합니다.
중소기업 문서 규모별 월 비용 비교
다음 비교는 세금계산서, 영수증, 발주서, 은행 거래명세서 등 다양한 문서 유형을 처리하는 한국 중소기업을 가정합니다. 세 가지 규모 시나리오는 각기 다른 사업 규모와 문서 처리량을 반영합니다. 모든 가격에는 해당되는 부가세가 포함되어 있습니다. 적용 환율은 ₩1,450/$1입니다.
| 시나리오 | 트랙 1: 홈택스 정부 | 트랙 2: 네이버 클로바 OCR 페이지당 API | 트랙 2: 이카운트 ERP + 기본 OCR | 트랙 3: ImageToTable.ai 달러 기반 AI |
|---|---|---|---|---|
| 월 50건 개인 사업자, 소규모 사무실 | 무료 전자세금계산서만 가능 | ~₩2,500 | ₩44,000 + 초기 비용 ₩220,000 | $9 (₩13,050) 개인, 150크레딧 |
| 월 150건 일반 중소기업 | 무료 세금계산서의 약 60%만 가능 | ~₩7,500 | ₩44,000 + 수동 입력 인건비 | $19 (₩27,550) 프로, 400크레딧 |
| 월 300건 중견 중소기업 | 무료 세금계산서의 약 60%만 가능 | ~₩15,000 | ₩44,000 + 상당한 수동 작업 | $59 (₩85,550) 맥스, 1,500크레딧 |
비용 비교를 보면 직관과 다른 패턴이 드러납니다. 월 50건 기준으로 네이버 클로바 OCR의 페이지당 과금이 실제로 가장 저렴한 옵션입니다 — 월 ₩2,500. 하지만 이 가격은 API 연동이 필요합니다: 개발자가 클로바 OCR을 업무 흐름에 연결하고, 원시 OCR 출력에서 데이터를 추출하는 파싱 로직을 구축하며, 연동을 유지보수해야 합니다. ₩2,500이라는 가격표에는 개발 비용이 포함되어 있지 않으며, 일회성 연동에 약 ₩500,000~₩1,500,000이 소요될 수 있습니다. 이를 1년으로 나누면 실질 월 비용은 ₩44,000~₩127,500으로 뛰어오르며, 클로바 OCR은 이카운트와 비슷한 수준이 되지만 지속적인 유지보수 부담이 추가됩니다.
월 150건에서는 코드 없는 정액제 도구가 분명한 경제적 승자가 됩니다 — 개발이 필요 없고, 페이지당 과금이 없으며, 필요하지 않을 수도 있는 ERP 안에 추출 기능이 묶여 있지 않습니다. 이카운트 가격은 월 ₩44,000으로 고정되어 있지만, 추출 기능은 볼륨에 따라 확장되지 않습니다 — 문서가 늘어나도 ERP 안에서 수동 입력만 늘어날 뿐입니다.
월 300건에서는 페이지당 API 도구가 정액제 대안에 비해 가격 우위를 잃기 시작합니다. 하지만 이 볼륨에서 더 중요한 변화는 운영 측면입니다: 월 300건을 처리하는 비즈니스는 더 이상 공급업체 레이아웃에 따라 추출 정확도가 달라지는 것을 감당할 수 없습니다. 템플릿 기반 OCR은 이러한 다양성 앞에서 한계를 드러냅니다. 달러 기반 도구든 DEEP OCR+와 같은 엔터프라이즈급 한국어 VLM 솔루션이든, 의미 기반 추출이 최소한의 실행 가능한 접근 방식이 됩니다.
트랙별 활용 시점: 의사 결정 프레임워크
올바른 추출 트랙은 세 가지 변수에 따라 달라집니다: 처리하는 문서 유형, 문서 수, 그리고 이미 사용 중인 ERP 시스템 유무입니다.
트랙 1만 사용하세요 — 등록된 한국 공급업체의 전자 세금계산서만 처리하고, 이미 홈택스나 ERP의 NTS 연동을 통해 조회하고 있다면 이 트랙이 적합합니다. 무료이고 안정적이며 데이터가 이미 구조화되어 있습니다. 추출이 필요 없고, 조회와 대사만 있으면 됩니다.
트랙 2를 주 플랫폼으로 사용하세요 — 전체 ERP나 회계 제품군이 필요하고, 내장 OCR이 영수증 및 표준화된 청구서 형식 등 문서 유형의 상당 부분을 처리할 수 있다면 적합합니다. Ecount, JOBIS, 더존이 재무 운영의 중추 역할을 합니다. 단, PDF 세금계산서, 발주서, 은행 거래 명세서, 공급업체별로 형식이 다른 문서는 수동 입력이 필요할 수 있습니다.
트랙 3을 기존 ERP 위에 추가하세요 — 이미 더존, Ecount, SAP 등 회계 시스템을 사용 중이고, 문서에서 데이터를 직접 입력하는 작업만 없애고 싶다면 이 트랙이 적합합니다. 추출 도구가 Excel로 내보내면, ERP가 Excel에서 가져옵니다. 연동은 파일 형식 자체입니다. 이는 작동 중인 회계 시스템을 유지하면서 데이터 입력 단계만 없애고자 하는 중소기업에 가장 적합한 접근 방식입니다.
트랙 3을 홈택스 대상 청구서에도 추출 계층으로 사용하세요 — 분석이나 보고를 위해 여러 출처의 데이터를 집계해야 할 때 적합합니다. 홈택스는 개별 청구서만 보여줍니다. 추출 도구를 사용하면 공급업체 청구서 50장을 일괄 처리하여 대사, 원가 분석, 감사 준비를 위한 단일 스프레드시트로 만들 수 있습니다. 세금계산서 심층 분석에서 이 특정 워크플로의 경제성을 자세히 살펴봅니다.
한국의 문서 추출 시장은 비싸지 않습니다. 잘못된 구매자를 대상으로 가격이 책정되어 있습니다. 데이터를 잘 추출하는 도구는 기업용으로 만들어졌습니다. 중소기업용으로 만들어진 도구는 추출이 부가 기능인 전체 ERP 제품군입니다. 세 번째 트랙은 월 13,050원이며, 회계 처리 방식을 전혀 바꾸지 않아도 됩니다.
자주 묻는 질문
AI 추출 도구가 처리할 수 있는 한국어 문서 유형은 무엇인가요?
세금계산서, 영수증, 발주서, 은행 거래 명세서, 납품서, 계약서, 급여명세서 등 대부분의 인쇄된 한국어 비즈니스 문서를 처리할 수 있습니다. 명확한 필드 레이블이 있는 인쇄/타자 문서에서 정확도가 가장 높습니다. 필기 문서는 가독성에 따라 정확도가 낮아질 수 있습니다. 한영 혼용 또는 한중 혼용 문서도 지원되며, AI는 페이지에 있는 모든 언어를 읽습니다.
환율 변동으로 달러 기준 도구가 장기적으로 불리해지나요?
이 글에서 사용된 1,450원/$1 환율은 2026년 중반 기준입니다. 환율 변동에 따라 원화 가격이 달라집니다. $9 요금제는 1,300원/$1이면 11,700원, 1,600원/$1이면 14,400원이 됩니다. 1,600원/$1에서도 달러 기준 도구는 한국 정액제 대비 상당한 비용 절감 효과를 제공합니다. 가격 차이는 구조적이며 환율에 의존하지 않습니다.
ERP가 전부 한국어여도 달러 기준 도구를 사용할 수 있나요?
네. ImageToTable.ai는 한국어 문서를 처리하여 Excel(XLSX) 또는 CSV 파일로 출력합니다. 이 형식들은 언어에 구애받지 않습니다. 한국어 ERP는 다른 스프레드시트를 가져오는 것과 동일한 방식으로 이 파일들을 가져옵니다. 추출 출력 열 이름은 한국어, 영어 또는 혼합으로 지정할 수 있으며, 도구가 열 헤더에 특정 언어를 강제하지 않습니다. 웹 인터페이스는 영어로 제공되며, 이것이 한국어 전용 사용자에게 유일한 불편 사항입니다.
네이버 클로바 OCR과 AI 의미 추출의 차이점은 무엇인가요?
클로바 OCR은 페이지에서 텍스트를 읽고 위치 데이터와 함께 문자열로 반환합니다. 그런 다음 해당 출력을 분석하여 공급자 이름, 금액 등을 식별해야 합니다. 이 분석 단계에는 맞춤 개발 또는 문서 레이아웃별 사전 학습 템플릿이 필요합니다. AI 의미 추출은 문서를 전체적으로 읽습니다. "공급가액" 옆에 있는 숫자가 페이지의 어디에 있든 공급가액임을 이해합니다. 공급자별 템플릿 구성이 필요하지 않습니다. 단점: 클로바 OCR의 페이지당 비용은 더 낮지만, 통합 비용과 템플릿 유지 관리 오버헤드로 인해 중소기업 규모에서는 그 이점이 사라질 수 있습니다.
규정 준수를 위해 온프레미스 문서 추출이 필요한 경우는?
클라우드 기반 AI 추출이 모든 한국 기업에 적합한 것은 아닙니다. 개인정보보호법에 따라 민감한 개인 데이터를 처리하거나 ISMS-P 인증 요건이 적용되는 기업은 온프레미스 솔루션이 필요할 수 있습니다. 삼성SDS Brity와 한국딥러닝의 DEEP OCR+가 이 시장을 담당하지만, 두 제품 모두 엔터프라이즈 가격입니다. 공급업체 청구서, 구매 주문서, 은행 거래 명세서 등 덜 민감한 문서의 경우, Ecount, JOBIS 등 기존 클라우드 ERP 플랫폼을 통해 클라우드 추출이 한국 중소기업에서 널리 사용됩니다.