수기 수표를 Xero로,
OCR이 건너뛰는 필드를 다시 입력하지 않고
가족 운영 CPA 업무를 인수한 북키퍼가 r/Bookkeeping 커뮤니티에 대부분의 회계 법인이 결국 마주치는 질문을 올렸습니다. 고객들이 여전히 수기로 수표를 작성하는데, 그 필기 내용을 Xero로 안정적으로 가져올 도구가 없다는 것이었습니다. 가장 많은 추천을 받은 답변은 업계의 현실을 요약했습니다. "Hubdoc, AutoEntry, Dext 같은 도구는 이미지 저장에는 좋지만, OCR은 보통 필기 내용을 놓칩니다." 이 한 문장이 수표를 저장하는 것과 읽는 것을 구분하며, 그 차이 때문에 수취인 이름과 금액이 계속 수작업으로 입력되고 있습니다.

핵심 요약
- 스캐너와 문서 도구는 이미 모든 수표를 저장하지만, 수취인과 금액은 여전히 수작업으로 입력됩니다.
- OCR은 은행이 기계용으로 설계했기 때문에 인쇄된 MICR 라인을 읽지만, 필기는 사람의 눈을 위해 작성되었기 때문에 단어 오류율이 문자 오류율보다 2~4배 높습니다.
- 열을 의미에 따라 한 번 정의하면 각 수표의 필드가 하나의 가져오기 가능한 스프레드시트에 담기며, 모든 값은 이미지의 정확한 위치로 다시 연결됩니다.
수표 보관과 판독의 차이

수표는 소기업 부기에서 사라지지 않았습니다. 재무 전문가 협회(Association for Financial Professionals)에 따르면 조사 대상 조직의 91%가 여전히 수표를 사용하며, 75%는 2년 내에 사용을 중단할 계획이 없다고 답했습니다 (AFP Payments Fraud and Control Survey). 연방준비제도(Fed)의 기업 결제 연구에 따르면 소규모 기업이 수표에 가장 크게 의존합니다. 매출 100만 달러 미만의 초소규모 기업 10곳 중 약 8곳이 여전히 지불에 종이 수표를 사용합니다. 수표책은 스스로 읽히지 않으므로, 회계 작업은 종이가 끝나는 지점에서 시작됩니다.
고객이 수기 수표 묶음을 건네주면, 회사의 문서 도구는 이미지를 캡처할 수 있습니다. Hubdoc, Dext 및 AutoEntry는 스캔을 저장하고 거래에 첨부하며 파일로 정리해 줍니다. 그러나 이들이 일관되게 해내지 못하는 것은 수기로 작성된 수취인, 날짜, 수표 번호 및 금액을 필드로 변환하는 일입니다. OCR 엔진은 인쇄된 텍스트를 잘 읽지만 필기체에서는 성능이 크게 떨어지며, 이 격차는 AutoEntry 도움말 센터에 명확히 문서화되어 있습니다. 펜 표시가 있는 파일은 소프트웨어가 "인쇄된 텍스트와 펜 표시를 구분하는 데 어려움을 겪기" 때문에 아예 거부됩니다. 실제 결과는 이미지는 보관되고 데이터는 여전히 수동으로 입력된다는 것입니다.
이것이 부기 담당자가 실제로 테스트하는 핵심 차이점입니다. 이미지를 저장하는 도구는 보존 문제를 해결합니다. 필드를 추출하는 도구는 입력 문제를 해결합니다. 소규모 기업의 대부분 수표 처리는 여전히 기존 방식으로 이루어지는데, 이는 수기 문서에 대해 캡처 계층과 추출 계층이 연결된 적이 없기 때문입니다.
오늘날 수기 수표가 거래로 기록되는 과정
수기 입력 방식은 대부분의 소규모 업체에서 일정한 형태를 띱니다. 고객이 수표를 작성해 종이 사본이나 휴대폰 사진을 건네면, 부기 담당자가 회계 소프트웨어를 열고 필체를 확인한 뒤 거래 화면에 날짜, 수취인 이름, 금액, 수표 번호, 메모를 입력합니다. 그런 다음 파일을 첨부하고, 은행 피드가 결제된 항목을 불러오면 동일한 거래를 다시 대사합니다.
두 번째 단계인 은행 피드는 많은 부기 담당자가 이미 문제의 절반을 해결한 부분입니다. 수표가 결제되면 은행 거래 내역 피드에 금액과 날짜가 들어옵니다. 부기 담당자는 이를 대사하고 분류하며, 원본 스캔본은 증빙 자료로 보관합니다. 이 워크플로는 실제로 작동하며, r/Bookkeeping 스레드에서도 권장하는 방식입니다. "증빙용으로 수표를 스캔한 뒤... 결제가 완료되면 은행 피드에 의존하세요."
하지만 은행 피드에는 한계가 있습니다. 며칠 뒤에야 도착합니다. 금액과 날짜는 제공하지만, 고객의 필체를 은행 직원이 직접 입력한 경우 수취인 이름은 제공하지 않습니다. 메모, 용도, 분류에 대해서는 이미지를 직접 확인하기 전까지 알 수 없습니다. 또한 입금을 기다리는 수취 수표처럼 계좌에서 결제되지 않는 수표에는 전혀 도움이 되지 않습니다. 남아 있는 수기 입력 작업이 바로 인간의 눈이 필요 없는 작업입니다.
OCR이 MICR 라인은 읽어도 필체는 건너뛰는 이유
수표에는 성격이 전혀 다른 두 종류의 텍스트가 숨어 있습니다. 하단의 숫자 줄인 MICR 라인은 자기 잉크 글꼴로 인쇄되며, 은행은 사진을 찍는 대신 자기 신호를 감지해 읽습니다. 그래서 모든 수표의 라우팅 번호와 계좌 번호가 안정적으로 읽히는 것입니다. ANSI X9.100-20에 정의된 E-13B 문자는 수표마다 일관되게 유지됩니다. 자기 레이어가 바로 기계용으로 설계된 부분입니다.
수표의 나머지 부분은 인간을 위해 설계되었고 손으로 작성됩니다. 수취인 이름, 금액(문자), 숫자 금액, 날짜, 메모는 작성자가 쓰는 스타일 그대로의 볼펜 잉크입니다. OCR이 여기서 어려움을 겪는 데는 세 가지 구조적 이유가 있습니다. 필체에는 고정된 글꼴이 없어 문자 모델과의 매칭이 실패합니다. 레이아웃이 수표마다 달라 "수취인은 항상 여기"라는 템플릿 위치가 없습니다. 그리고 오류 비용이 비대칭적입니다. 필체의 경우 단어 오류율이 일반적으로 문자 오류율보다 2~4배 높은데, 한 글자를 잘못 읽으면 단어 전체가 실패하기 때문입니다. 이는 수취인 이름이나 금액에 가장 치명적인 실패 방식입니다(필기 인식 정확도 데이터 참조).
부기용으로 만들어진 캡처 도구는 의도적인 절충을 합니다. 인쇄된 청구서와 영수증은 매우 잘 추출하지만, 필체는 빈 값으로 반환하거나 수동 입력 대상으로 표시해 회피합니다. Reddit 스레드에는 그 합의가 잘 드러나 있습니다. "OCR은 보통 인쇄된 청구서와 명세서에서는 잘 작동하지만, 필체는 스타일이 너무 다양해서 난이도가 한층 더 높아집니다." 부기 담당자가 잘못하고 있는 것이 아닙니다. 그들이 받은 도구 스택이 필체 앞에서 멈춰 설 뿐입니다.
실패의 원인은 문서가 아닙니다. 텍스트를 읽는 OCR과 문서를 읽는 의미 기반 데이터 추출이 같은 기술이라는 가정이 문제입니다. 둘은 다릅니다.
OCR이 놓치는 부분을 읽어내는 워크플로우
필기체를 이해하는 추출 기능은 사람이 수표를 읽는 방식과 동일합니다. '수취인', '날짜', '금액', '수표 번호'를 개념으로 처리한 다음, 각 항목이 어디에 있든 찾아냅니다. 맞춤 열 추출을 사용하면 회계 담당자가 원하는 열을 평범한 단어로 한 번만 입력하면, AI가 스캔된 수표에서 픽셀 위치가 아닌 의미를 기준으로 값을 찾아냅니다. 열이 사용자에 의해 정의되므로, 동일한 설정은 모든 고객의 수표에 대해 동일한 스프레드시트 구조를 생성합니다.
필기 수표 배치를 위한 열 템플릿은 오늘날 회계 담당자가 입력하는 필드에 직접 매핑됩니다:
| 열 | AI가 찾는 항목 | 중요한 이유 |
|---|---|---|
| 수표 번호 | 수표 앞면의 일련번호 | 은행 피드와 일치하며 중복을 찾아냅니다 |
| 날짜 | 기재된 날짜 (모든 형식) | Xero의 거래 날짜를 결정합니다 |
| 수취인 | "Pay to the order of" 줄에 적힌 이름 | OCR이 가장 자주 빈 값으로 반환하는 필드입니다 |
| 금액 | 숫자 금액; 기재된 금액은 두 번째 열로 추출하여 검토자가 둘을 비교할 수 있습니다 | 숫자 하나가 틀리면 조정 오류가 발생합니다 |
| 메모 | 메모 줄에 적힌 용도 또는 참조 사항 | 카테고리 및 송장 정보를 전달합니다 |

두 가지 설정이 배치를 현실적으로 만듭니다. 더 높은 모델 티어는 빽빽하거나 필기체로 된 손글씨에 더 강력한 시각 처리를 제공하며, 이는 필체가 흐트러진 고객의 수표를 처리할 때 중요합니다. 전체 스택이 여러 파일을 동시에 처리하므로, 한 고객의 수표 묶음은 단일 배치로 처리되어 파일 하나씩 처리하는 대신 하나의 스프레드시트로 병합됩니다.
출력은 두 가지 경로 중 하나를 통해 소프트웨어로 들어갑니다. 열은 다른 은행 또는 분개 가져오기처럼 Xero로 가져올 수 있는 스프레드시트에 저장되거나, 추출된 행이 확인되어 직접 입력됩니다. 핵심은 더 이상 필기 내용을 두 번 입력할 필요가 없다는 것입니다. 입력 작업은 이미 추출기가 수행했습니다. 단일 수표에 적용되는 동일한 필드 수준 판독에 대한 자세한 설명은 필기 원장을 Excel로 변환 문서에 있으며, 필기 영수증을 세금 신고용 스프레드시트로 만드는 더 광범위한 패턴도 확인할 수 있습니다.
게시 전에 금액 확인하기
수기 추출은 맹목적인 신뢰의 과정이 아닙니다. 수표 금액은 회계 담당자가 조용히 오독하기 가장 싫은 부분입니다. APQC 벤치마크에 따르면 지급 처리 건당 중간 비용은 $6이며(APQC), 대부분 수동 입력 비용이며, 중간 규모 업체는 여전히 공급업체 인보이스의 60%를 수동으로 입력합니다. 검토 단계는 자동화의 가치가 입증되는 곳입니다. 추출 결과를 검증하는 것이 다시 입력한 후 검증하는 것보다 저렴합니다.
수기의 경우, 검증 도구는 전체가 아니라 핵심입니다. 검토 모드를 사용하면 회계 담당자가 추출된 셀 위에 마우스를 올리거나 클릭하여 원본 수표 이미지에서 해당 값이 나온 위치를 정확히 확인할 수 있고, 이미지에서 해당 영역을 클릭하면 일치하는 셀로 다시 이동할 수 있습니다. 금액 숫자가 모호한 경우, 업체는 그 숫자를 만든 필체를 볼 수 있으며 출처가 불분명한 숫자를 신뢰하지 않아도 됩니다. 잘못된 판독은 수정할 수 있고, AI의 원래 값은 한 번의 클릭으로 기록에 남아 감사 추적이 유지됩니다. 이것이 검토 기능이 내장된 도구와 CSV를 내보내고 기대하는 도구의 차이입니다.
동일한 원칙은 이미 은행 피드로 처리 중인 수표에도 적용됩니다. 여기서 피드를 대체하는 것은 없으며, 대조 단계를 단축할 뿐입니다. 결제 금액이 도착하면, 자체 배치에서 추출된 행이 수취인과 메모를 제공하므로 각 이미지를 열지 않고 스프레드시트에서 분류하고 대조할 수 있습니다.
여전히 사람이 필요한 부분
추출은 수기를 읽는 것이며 마법이 아닙니다. 흐린 잉크, 필기체가 심한 금액, 비스듬히 또는 저조도에서 촬영된 수표는 신뢰도가 낮은 필드를 생성하며 회계 담당자가 여전히 확인해야 합니다. 정직한 워크플로우는 모든 배치에 검토 과정을 계획하며, 예외가 없다고 가정하지 않습니다. 이것이 위의 검증 단계가 부차적인 것이 아니라 설계의 일부인 이유입니다.
나머지 체인에도 한계가 있습니다. 결제되지 않은 수표는 대조할 은행 피드 항목이 없으므로 추출된 행이 유일한 기록이며 정확성이 더 중요합니다. 그리고 보관도 여전히 중요합니다. IRS Publication 583은 기업이 보관해야 하는 증빙 문서에 결제된 수표를 포함합니다(IRS Publication 583). 전자 시스템은 기록이 읽기 쉽고 검색 가능하게 유지되는 경우에만 그 의무를 충족합니다. 이미지 저장은 보존을 해결하고, 필드 추출은 입력을 해결합니다. 업체는 두 가지를 모두 계속 수행하며, 이것이 바로 캡처와 추출 계층이 각자의 역할을 수행하는 별도의 도구여야 하는 이유입니다.
수표 판독의 은행 수준 측면, MICR 처리, 수표 사기 확인, KYC 검증에 대해서는 OCR in banking 가이드에서 기관 워크플로우를 다룹니다. 이 문서는 더 작은 규모에 관한 것입니다. 회계 담당자 책상 위의 수기 수표 더미와 그로 인해 Xero에 입력되는 내용입니다.
수기 수표와 회계 소프트웨어: FAQ
Hubdoc에서 수기 수표를 읽을 수 있나요?
Hubdoc는 수표 이미지를 저장하고 인쇄된 문서에서 헤더 필드를 추출하지만, 문서와 사용자 보고에 따르면 필기체는 안정적으로 읽히지 않습니다. 수취인과 금액은 종종 비어 있는 채로 반환되어 수동으로 입력됩니다. Hubdoc는 여전히 견고한 문서 저장 및 분류 계층으로, 이는 추출과는 별개의 작업입니다.
Xero에 수기 수표용 OCR 기능이 내장되어 있나요?
Xero 자체에는 문서 OCR 기능이 없습니다. 번들로 제공되는 캡처 도구인 Hubdoc가 읽기를 담당하며, 수기 수표는 그 공백을 통해 누락됩니다. Xero는 가져온 데이터와 은행 피드를 허용하므로, 실질적인 방법은 수표 필드를 스프레드시트로 추출한 다음 행을 가져오는 것입니다. CSV 및 IIF 가져오기를 지원하는 QuickBooks에도 동일한 논리가 적용됩니다.
수표의 필기체 추출 정확도는 어느 정도인가요?
깨끗한 벤치마크 필기체의 경우 최신 AI 시스템은 문자 오류율 2% 미만에 도달하지만, 실제 문서에서는 도구와 필체에 따라 대략 46%에서 95%까지 정확도 범위가 넓습니다. 가독성, 잉크 품질, 스캔 해상도가 결과를 좌우합니다. 이러한 편차는 바로 각 값이 어디서 왔는지 강조하는 검토 단계가 자신 있는 정확도 주장보다 더 중요한 이유입니다.
수표를 추출해도 은행 피드가 여전히 필요한가요?
네, 둘은 함께 작동합니다. 은행 피드는 실제로 결제된 내역에 대한 권위 있는 기록이며, 추출은 피드에 포함되지 않은 수취인과 메모 세부 정보를 제공합니다. 작업 흐름은 배치 추출, 필드 검토, 결제된 피드와 대조라는 단계로 축소됩니다.
수기 수표에 필요한 스캔 품질은 무엇인가요?
평평하고 조명이 밝은 약 300 DPI 이미지가 가장 좋은 결과를 제공합니다. 수표가 평평하고 필기체에 초점이 맞춰져 있다면 휴대폰 사진으로도 충분하며, 대량의 수표 묶음에는 스캐너가 더 좋습니다. 금액란에 비스듬한 각도와 그림자가 생기지 않도록 하세요. 이러한 조건은 필기체를 낮은 신뢰도 영역으로 밀어넣는 요인이기 때문입니다.
기업이 수기 수표를 처리하는 방식의 유용한 전환점은 "이미지를 저장할 수 있는가"라는 질문을 멈추고 "열을 정의할 수 있는가, 수취인을 읽을 수 있는가, 게시 전에 금액을 확인할 수 있는가"라는 질문을 시작하는 것입니다. 스택에 있는 모든 캡처 도구는 이미 첫 번째 작업을 수행합니다. OCR이 비워 두는 필드가 바로 자동화할 가치가 있는 부분입니다.