영국 SA100 세금 신고 데이터를 Excel로 추출 — 세금 필드 이름을 지정하세요, 박스 위치가 아닌
대부분의 SA100 추출기는 스프레드시트를 보기 전에 파이프라인과 연도별 템플릿이 필요한 API 전용 플랫폼입니다. 하지만 이 도구는 각 박스의 의미를 기준으로 SA100과 보충 페이지를 읽으므로, 동일한 열 이름이 매년 그대로 작동합니다. PDF를 넣으면 5~10초 안에 필드를 추출할 수 있습니다.
Enterprise-grade security · TLS 1.3 encrypted
영국 SA100 서류에서 추출할 수 있는 항목
필요한 열 이름을 입력하세요. AI는 상자 라벨의 의미를 기준으로 기본 양식이나 보충 페이지에서 각 수치를 찾아냅니다. 위치가 아니라 의미를 기준으로 합니다. 동일한 열이 HMRC 포털 PDF, TaxCalc 다운로드, 스캔한 종이 신고서에서도 동일하게 작동합니다.
출력 항목을 직접 정의하면 AI가 문서를 읽습니다. 고객 신고서에 포함된 모든 필드를 추가할 수 있으며, 위 목록은 대부분의 영국 신고자가 필요로 하는 기본 항목입니다.
SA100 추출이 위치가 아닌 의미에 기반해야 하는 이유
SA100은 단일 양식이 아니라 묶음입니다. 본 신고서(TR1~TR6)와 최대 7개의 보충 페이지의 합계가 본 양식으로 합산되며, 각 소프트웨어는 해당 입력란을 서로 다르게 표시합니다. 경쟁사는 엔터프라이즈 API와 연도별 템플릿으로 이 문제를 해결합니다. 여기에 차이가 있습니다.
문제점
기본 SA100 양식 8번란의 과세 이익은 SA103S의 합계에서 비롯됩니다. 페이지별로 단독 읽으면 이러한 연결이 끊어지며, 수동 전사자는 해당 란이 출처와 일치하는지 확인하기 위해 문서 사이를 오가야 합니다.
HMRC 포털 다운로드, TaxCalc PDF, FreeAgent 내보내기, 스캔한 종이 신고서 모두 동일한 UTR과 동일한 소득 란을 서로 다른 좌표에 담고 있습니다. 한 레이아웃으로 학습된 템플릿은 다른 레이아웃을 오독하며, 이는 r/UKPersonalFinance의 납세자들이 기대한 필드가 찾던 위치에 없을 때 겪는 문제와 정확히 일치합니다.
SA100 레이아웃은 과세 연도마다 변경되며, 소득세 디지털 신고(MTD for ITSA)가 신고 방식을 재편하고 있습니다. 개정 때마다 좌표 기반 영역이 무효화되므로 위치 기반 추출은 매 시즌 재작업이 필요하거나, 오래된 신고서에서는 조용히 오류를 일으킵니다.
맞춤 열 추출이 이 문제를 해결하는 방법
맞춤 열 추출은 원하는 필드를 입력하면 AI가 해당 라벨의 의미를 기반으로 각 항목을 읽어냅니다. 라벨이 패킷의 어디에 있든 상관없습니다. 좌표도, 렌더러별 영역도, 모델 학습도 필요 없습니다.
"자영업 소득"을 한 번 정의하면 SA103S에서 추출하고, "부동산 소득"을 정의하면 SA105에서 읽어옵니다. 동일한 세트가 메인 양식의 1번 항목 근로소득도 포착합니다. 보충 페이지에 별도의 템플릿이나 추가 설정이 필요 없습니다.
추출이 위치가 아닌 의미를 따르기 때문에, HMRC가 레이아웃을 변경하거나 고객이 소프트웨어를 바꿔도 동일한 열 이름이 계속 작동합니다. 작년의 정의가 올해도, 내년에도 그대로 유효합니다.
고객의 SA100 서류 꾸러미에서 준비된 스프레드시트까지, 세 단계로
1월 마감을 앞두고 본인 또는 고객의 자진 신고(Self Assessment)를 준비 중이라면, 업로드부터 세무 소프트웨어에 필요한 스프레드시트 생성까지의 전체 워크플로우를 여기서 확인하세요.
서류 꾸러미 전체를 업로드하세요
기본 SA100 양식과 자영업용 SA103S, 임대소득용 SA105 등 모든 보충 페이지를 PDF나 사진으로 넣으세요. HMRC 포털에서 내려받은 파일, TaxCalc 파일, 스캔한 서류를 모두 한 번에 넣을 수 있습니다. AI가 생성 도구별로 미리 분류할 필요가 없습니다. 고객이 직접 파일을 보내는 경우, Collection Link를 공유해서 등록 절차 없이 바로 업로드하게 하세요.
필요한 세무 항목을 입력하세요
열 이름을 한 번만 지정하면 됩니다: "UTR", "국민보험번호", "근로소득", "자영업 소득", "부동산 소득", "총소득", "개인 공제", "과세 소득", "납부 세액", "학자금 대출 상환액". AI가 라벨 의미를 기준으로 각 항목을 읽어 서류 꾸러미의 모든 페이지에서 해당 행을 채웁니다. "잔액" 같은 계산 열을 추가하면 추출 중에 계산도 실행됩니다.
필요한 세무 항목을 입력하세요
열 이름을 한 번만 지정하면 됩니다: "UTR", "국민보험번호", "근로소득", "자영업 소득", "부동산 소득", "총소득", "개인 공제", "과세 소득", "납부 세액", "학자금 대출 상환액". AI가 라벨의 의미를 읽고 각 입력란을 채워 서류 꾸러미의 모든 페이지에 걸쳐 데이터를 정리합니다. "잔액" 같은 계산 열을 추가하면 추출 중에 자동으로 계산됩니다.
필요한 세무 항목을 입력하세요
열 이름을 한 번만 지정하세요: "UTR", "국민보험번호", "근로소득", "자영업 소득", "부동산 소득", "총 소득", "개인 공제", "과세 소득", "납부 세액", "학자금 대출 상환액". AI가 라벨의 의미를 기준으로 각 란을 읽고 꾸러미의 모든 페이지에 걸쳐 행을 채웁니다. "잔액" 같은 계산 열을 추가하면 추출 중에 계산이 실행됩니다.
신고서별 Excel 1개 또는 신고서당 1행으로 다운로드
XLSX 또는 CSV로 내보내세요. 일괄 처리된 신고서는 각각 한 행이 되어 첫 열에 UTR, 그다음 열에 소득·세액 항목이 이름별로 채워집니다. 장부와 대조하거나 신고 소프트웨어에 넘기기만 하면 됩니다. 검토 모드(Review Mode)는 원본 페이지에서 각 값의 출처를 강조 표시하므로, 여섯 페이지를 다시 읽을 필요 없이 몇 초 만에 검증할 수 있습니다.
가장 효과적인 경우 — 그리고 결과를 확인해야 하는 경우
가장 효과적인 경우
디지털 및 깨끗하게 스캔된 SA100. HMRC 포털 PDF, TaxCalc 또는 FreeAgent에서 생성된 소프트웨어 신고서, 200–300 DPI로 스캔한 평판 스캔은 박스 라벨이 기계 인쇄되어 있어 높은 정확도로 추출됩니다.
보충 페이지가 포함된 다중 페이지 문서. SA103S 자영업 및 SA105 부동산 수치는 동일한 패스에서 기본 양식과 함께 추출됩니다 — 영국 신고자가 가장 많이 필요로 하는 항목입니다.
고객 신고서 일괄 처리. 여러 SA100을 한 번에 업로드하고 신고서당 한 행씩 구성된 단일 스프레드시트로 내보내면 1월 정산 작업이 실용적으로 이루어집니다.
주의가 필요한 경우
손으로 많이 작성했거나 품질이 낮은 이미지. 손으로 채운 박스는 정확도를 떨어뜨리며, 그림자가 지거나 각도가 기울어진 휴대폰 사진은 작은 글씨의 보충 수치가 흐려질 수 있습니다. 깨끗한 스캔이 급하게 찍은 사진보다 항상 더 나은 성능을 보입니다.
이 도구는 데이터를 추출할 뿐, 신고서를 제출하지 않습니다. 이 도구는 구조화된 스프레드시트를 생성하며, HMRC 제출은 여전히 신고 소프트웨어를 통해 이루어집니다. 제출에 반영되기 전에 수치를 확인하세요.
빈 박스는 빈 상태로 유지됩니다. AI는 인쇄된 내용만 추출합니다. 신고서에 실제로 부동산 소득이 없다면 부동산 소득 열은 빈 상태로 유지됩니다 — 추측하거나 다른 곳에서 수치를 가져오지 않습니다.
자주 묻는 질문
스캔한 종이 SA100에서 데이터를 추출할 수 있나요?
네, 인쇄된 텍스트가 사람의 눈으로 읽을 수 있을 만큼 선명하다면 가능합니다. AI는 "납부 세액" 및 "UTR"과 같은 필드 라벨을 좌표가 아닌 의미로 읽기 때문에, 스캔한 종이 신고서도 HMRC 포털 PDF와 동일하게 처리됩니다. 200~300 DPI의 평판 스캔이 가장 좋은 결과를 제공합니다. 그림자가 진 휴대폰 사진만 있는 경우, 검토 모드에서 작은 글씨의 보충 페이지 수치를 확인해야 합니다.
SA103S 또는 SA105와 같은 보충 페이지에 대해 별도 설정이 필요한가요?
아니요. 하나의 열 이름 세트로 전체 문서를 처리합니다. "자영업 소득"을 정의하면 AI가 SA103S에서 해당 값을 찾고, "부동산 소득"을 정의하면 SA105에서 읽습니다. 동시에 동일한 열이 기본 양식의 근로소득과 배당소득도 포착합니다. 추출이 박스의 의미를 따르기 때문에 보충 페이지별 템플릿을 만들거나 유지 관리할 필요가 없습니다.
모든 항목 대신 UTR과 납부 세액 같은 일부 필드만 추출할 수 있나요?
바로 그렇게 작동합니다. 맞춤 열 추출은 이름을 지정한 열만 반환합니다. "UTR"과 "납부 세액"을 입력하면 출력 테이블에는 해당 두 열만 포함됩니다. 이것이 이 도구와 고정 스키마 API 추출기의 차이점입니다. 고정 스키마 API는 미리 정의된 필드 세트를 반환하므로 이후에 직접 필터링해야 합니다. 필드를 2개 정의하든 20개 정의하든, AI는 요청한 항목만 읽습니다.
HMRC가 양식 레이아웃을 변경하거나 MTD for ITSA 도입 후에도 작동하나요?
네. 위치 기반 템플릿은 HMRC가 레이아웃을 개정하거나 다른 소프트웨어 렌더러에서 생성된 신고서가 들어오면 작동이 중단됩니다. 이것이 경쟁 플랫폼이 사용자에게 전가하는 유지 관리 부담입니다. 의미 기반 추출은 좌표에 의존하지 않으므로 동일한 열 정의가 레이아웃 개정 후에도 계속 작동합니다. 또한 과거 문서도 동일한 방식으로 읽기 때문에 소득세 디지털 신고(MTD for ITSA)로 새 신고 방식이 바뀐 후에도 과거 SA100을 계속 추출할 수 있습니다.
손글씨가 있거나 완벽하지 않은 신고서에서 정확도는 어떤가요?
인쇄된 SA100 필드는 매우 높은 정확도로 추출됩니다. 이는 HMRC 포털 및 소프트웨어 생성 신고서의 일반적인 경우입니다. 손글씨는 솔직히 한계가 있습니다. 또렷하게 작성된 숫자는 잘 추출되지만, 보충 페이지의 작고 급하게 쓰였거나 번진 손글씨는 개별 수치의 정확도를 떨어뜨릴 수 있습니다. 손글씨가 있거나 고객의 수치가 특이한 신고서의 경우, 숫자가 어디에도 사용되기 전에 검토 모드를 실행하여 추출된 각 값이 원본 페이지의 어느 부분에서 왔는지 정확히 확인하세요.