AI W-2 및 1099 추출을 세무 준비
파이프라인에 적용하는 방법
2026년 기준 80만 명 이상의 세무 대리인이 유효한 PTIN을 보유하고 있으며, IRS는 평균 1040 작성에 13시간이 소요된다고 추정합니다. 그 시간의 3분의 1 이상이 반복적인 작업 하나에 사용됩니다. 바로 W-2 및 1099 박스의 숫자를 스프레드시트에 입력하는 작업입니다. 스프레드시트 단계는 선택 사항이 아닙니다. 모든 주요 세무 준비 패키지는 Excel 또는 CSV에서 가져오기 때문입니다. 핵심은 데이터가 시트에 어떻게 들어가는지입니다.
핵심 요점
- 200건의 신고를 처리하는 회사는 매 시즌 16,000~24,000개의 개별 W-2 및 1099 박스 값을 스프레드시트에 입력합니다. 이 모든 값은 이미 PDF 안에 기계가 읽을 수 있는 텍스트로 존재합니다.
- 모든 주요 세무 준비 패키지는 이미 Excel에서 가져오기를 지원하므로 병목 현상은 가져오기 단계가 아니라 양식에서 스프레드시트로 옮기는 단계입니다. 이 단계에서는 구조화된 데이터를 모두 처리할 수 있는 두 기계가 키보드로 분리되어 있습니다.
- ImageToTable.ai는 세무 소프트웨어가 이미 가져오는 것과 동일한 스프레드시트 열을 채우므로 스프레드시트를 감사 표면 및 워크페이퍼로 유지하면서 시간 배분을 데이터 입력 70%에서 실질 검토 70%로 전환합니다.
세무 소프트웨어, 이미 스프레드시트에서 가져오기 지원
Drake Tax는 Excel에서 자산 및 8949 거래를 가져옵니다. UltraTax CS는 스프레드시트에서 명세서 데이터를 가져옵니다. Forrester 연구에 따르면 자동 데이터 전송 기능을 사용하는 UltraTax를 도입한 회사의 준비 시간이 85% 단축되었습니다. ProConnect Tax는 Excel 통합 문서에서 감가상각, Schedule D, 파트너 및 주주 데이터를 가져옵니다. TaxWise, ATX, CrossLink — 모두 스프레드시트를 지원합니다.
좋은 소식입니다. 가져오기 단계 자체가 문제가 아니라는 뜻이니까요. 문제는 한 단계 앞에 있습니다. 모든 W-2와 1099의 각 Box 값은 가져오기 대화상자에 도달하기 전에 여전히 수동으로 입력됩니다.
W-2 2개와 1099 3개가 포함된 신고서의 경우, 작성자는 여러 양식에 걸쳐 약 80~120개의 개별 Box 값을 입력해야 합니다. 시즌당 200건의 신고서로 계산하면 금방 부담스러운 숫자가 됩니다. Thomson Reuters 연구에 따르면, 세무 전문가들은 데이터 입력과 같은 반응형 업무에 시간의 56%를 소비하지만, 실제로는 그러한 업무에 28%만 할애하기를 원합니다. 스프레드시트에서 세무 소프트웨어로의 가져오기가 병목이 아닙니다. 양식 데이터를 스프레드시트에 넣는 것이 병목입니다.
진짜 병목: 양식 데이터를 스프레드시트에 입력하는 과정
세무사들은 이 과정에 대한 근육 기억을 발달시킵니다. 화면 한쪽에 PDF W-2를 열고, 다른 쪽에 준비 스프레드시트를 띄운 후 시작합니다: Box 1, Box 2, Box 3, Box 4, Box 5, Box 6, 고용주 EIN, 고용주 이름, 주 ID 번호, 주 임금, 주 세금 — 다음 행으로 클릭, 다음 W-2 로드, 반복. 체계적이면서도 오류가 발생하기 쉽습니다. Box 2에서 숫자 두 자리를 잘못 입력하면 신고서 진단 시 연방 원천징수액이 일치하지 않게 됩니다.
일부 작성자는 지름길을 시도합니다. 세무 소프트웨어의 W-2 가져오기 기능을 사용하는 것입니다. Drake는 ADP를 통한 W-2 가져오기를 제공하고, ProConnect는 Intuit Link를 통해 W-2 데이터를 가져옵니다. 그러나 이러한 기능은 고용주가 호환되는 급여 제공자를 사용하는 경우에만 가능합니다. 수만 개의 소규모 고용주가 W-2를 발행하고 개인 고객으로부터 1099-NEC 양식이 들어오는 상황에서 가져오기 적용 범위는 보편적이지 않습니다. r/taxpros의 한 작성자는 이렇게 단호하게 말했습니다: "가져오기해서 시스템 기다리는 것보다 그냥 수동으로 W-2 입력하고 검토하는 게 더 빠릅니다." 가져오기 도구 자체가 마찰이 될 때, 작성자는 다시 수동 입력으로 돌아갑니다.
이것이 파이프라인이 깨지는 지점입니다. 세무 소프트웨어 쪽이 아니라, 양식에서 스프레드시트로 가는 쪽에서 말이죠.
파이프라인: 수집 → 추출 → 공급
3단계 파이프라인은 다운스트림을 건드리지 않고 수동 입력을 대체합니다:
3단계가 전체 파이프라인의 핵심입니다: 다운스트림은 아무것도 바뀌지 않습니다. 스프레드시트 구조, 열 레이아웃, 가져오기 매핑 — 모두 회사가 이미 사용하는 방식 그대로 유지됩니다. 바뀌는 것은 셀에 값이 들어오는 방식뿐입니다. 양식당 3분의 수동 입력에서 배치당 몇 초의 추출로 바뀝니다.
스프레드시트가 통합 레이어입니다. 세무 소프트웨어는 스프레드시트에서 가져오며 — 이 단계는 바뀌지 않습니다. 바뀌는 것은 데이터가 스프레드시트에 들어오는 방식뿐입니다: 수동 입력에서 사이드바 추출로. 지원되는 필드 유형, 형식, 플랜 세부 정보 등 전체 기능 개요는 Google Sheets 추출 페이지를 참조하세요.
스프레드시트 레이어가 유지되는 이유
목표가 순수한 자동화라면 — 서류가 들어가면 결과물이 나오는 방식 — 스프레드시트를 건너뛰어도 된다. 일부 도구는 정확히 그런 기능을 약속한다: 원본 문서를 세무 소프트웨어에 직접 업로드하여 스프레드시트를 우회하는 방식이다. 하지만 그 접근법은 한 가지 문제를 다른 문제로 바꿀 뿐이다.
스프레드시트는 단순한 데이터 전송 수단이 아니다. 다른 사람의 세금 신고서를 검토하는 준비자에게는 감사 표면이다 — 모든 Box 값이 세무 소프트웨어 양식 엔진의 블랙박스에 들어가기 전에 나란히 표시되는 유일한 공간이다. 행을 따라 읽으면서 — Box 1 임금, Box 2 연방 원천징수, Box 4 사회보장 원천징수 — 준비자는 맹목적 가져오기가 놓칠 불일치를 발견한다. 2025년 사회보장 임금 기준선은 $176,100이다. Box 3에 $200,000이 표시되고 Box 4가 0이면 뭔가 잘못된 것이다. 이런 합리성 검토는 세무 소프트웨어의 진단 실행이 아닌 스프레드시트에서 이루어진다.
특히 소규모 회사의 경우 스프레드시트는 워크페이퍼이기도 하다. 가져오기를 공급하는 동일한 시트가 신고서의 증빙 문서가 된다. A열은 고객 이름, B열은 양식 유형, C열부터 V열까지는 Box 값이다. 검토자가 "이 숫자는 어디서 나온 것인가"라고 묻으면 준비자는 PDF 스크린샷이 아닌 스프레드시트 행을 가리킨다. 추출이 세무 소프트웨어 양식에 직접 공급되면 이런 감사 추적은 존재하지 않는다.
이것이 수집 → 추출 → 공급의 3단계 파이프라인이 스프레드시트 단계를 제거하지 않고 유지하는 이유이다. 세무 소프트웨어에 직접 공급되는 AI 추출도 나름의 역할이 있지만, 스프레드시트를 중간 레이어로 유지하면 검토 프로세스, 워크페이퍼 습관, 가져오기 루틴이 모두 그대로 유지된다. 입력 방법만 바뀌고 워크플로우는 바뀌지 않는다.
변경되는 것과 변경되지 않는 것
세무 신고 파이프라인에 스프레드시트 계층에서 AI 추출을 추가하면 변경 범위는 좁고 의도적으로 제한됩니다:
| 동일하게 유지되는 것 | 변경되는 것 |
|---|---|
| 스프레드시트 열 구조 — Box 1, Box 2, Box 3 등 | 셀 값이 수동 입력 대신 AI로 추출됩니다 |
| 세무 소프트웨어로 가져오기 — 동일한 메뉴 경로, 동일한 파일 형식 | 일괄 처리가 한 번에 하나씩 입력하던 방식을 대체합니다 |
| 검토 단계 — 준비자가 각 행을 계속 확인합니다 | 검토가 "제대로 입력했나?"에서 "AI가 Box를 정확히 읽었나?"로 바뀝니다 |
| 워크페이퍼 — 동일한 스프레드시트가 증빙 문서 역할을 합니다 | 양식당 시간이 2~3분의 입력에서 몇 초의 검증으로 단축됩니다 |
| 세무 소프트웨어 — Drake, UltraTax, ProConnect 등 사용 중인 프로그램 | Collection Link가 고객이 직접 사용할 수 있는 문서 수집 프런트 엔드를 추가합니다 |
검토는 사라지지 않습니다 — 데이터 입력 검토에서 데이터 정확성 검토로 전환될 뿐입니다. 이전에 신고서 시간의 70%를 데이터 입력에, 30%를 실질 검토에 사용하던 준비자는 그 비율을 뒤집을 수 있습니다.
모든 세무 소프트웨어에서 작동합니다
스프레드시트 기반 파이프라인이 작동하는 이유는 특정 세무 소프트웨어 업체의 독점 가져오기 API에 의존하지 않기 때문입니다. 모든 세무 신고 패키지가 이미 지원하는 단 하나의 형식, 즉 구조화된 스프레드시트 데이터에 의존합니다. 널리 사용되는 세 가지 패키지에서의 가져오기 과정은 다음과 같습니다:
- Drake Tax: Import → Form 8949 Import / GruntWorx Trades, 또는 Tools → File Maintenance → Import Data for QuickBooks files. Drake는 대규모 고용주의 경우 ADP에서 W-2 다운로드도 지원하지만, 고용주가 ADP 고객이 아닌 수천 명의 고객에게는 화면
W2에서의 수동 W-2 데이터 입력이 기본입니다. - UltraTax CS: Excel에서 명세서 데이터 가져오기가 통합 메뉴에 내장되어 있습니다. Thomson Reuters가 의뢰한 Forrester 연구에 따르면, UltraTax으로 데이터 전송을 자동화한 회사는 준비 시간이 85% 단축되었습니다.
- ProConnect Tax: Input Return → 번개 아이콘 → 스프레드시트 찾아보기. Excel에서 감가상각, Schedule D, 파트너, 주주, 수익자 데이터 가져오기를 지원합니다. Intuit Link가 고객 대상 문서 제출을 처리합니다.
모든 경우에 세무 소프트웨어의 가져오기 대화상자는 스프레드시트의 열을 찾고 있습니다. 해당 셀이 사람이 입력했든 AI 추출로 채워졌든 소프트웨어에는 보이지 않습니다. 회사의 비용 차이는 보이지 않습니다 — 신고서마다 누적됩니다.
자주 묻는 질문
W-2 및 1099 양식의 AI 추출 정확도는 어느 정도인가요?
인쇄된 세금 양식 데이터는 일반적으로 높은 정확도로 추출됩니다. W-2와 1099는 기계로 생성된 표준화된 양식으로, 각 항목이 명확히 표시된 상자에 있어 AI 추출에 적합합니다. 손으로 작성되었거나 저해상도로 스캔된 양식은 정확도가 낮아집니다. 스프레드시트 계층이 안전망 역할을 합니다. 추출된 모든 값은 셀에 입력되어, 작성자가 입력 전에 육안으로 확인할 수 있으며, 이는 수동 입력 값을 검토하는 방식과 동일합니다.
손으로 작성된 W-2나 1099는 어떻게 처리하나요?
소규모 고용주가 손으로 W-2를 작성하거나 1099-NEC 양식을 수기로 기입하는 경우가 있습니다. AI 추출은 필기체도 처리할 수 있지만, 정확도는 가독성에 따라 달라집니다. 부분적으로 손으로 작성된 양식의 경우, 기계로 인쇄된 양식보다 더 많은 필드를 확인해야 합니다.
주(state)별 세금 양식에도 적용되나요?
표준 연방 W-2 양식에는 Box 15~20에 주 정보가 포함되어 있습니다. 주(state) 전용 양식은 레이아웃이 다릅니다. 열 추출 방식은 필요한 항목의 이름을 지정할 수 있는 모든 양식에 적용 가능하지만, 비표준 레이아웃의 주 양식의 경우 파이프라인에 구축하기 전에 샘플로 테스트해 보시기 바랍니다.
고객의 주민등록번호(SSN)와 데이터 보안은 어떻게 되나요?
W-2에는 SSN이 포함되어 있으며, 이는 IRS 간행물 4557 및 세무 대리인을 위한 FTC Safeguards Rule 요건에 따른 민감 데이터입니다. ImageToTable.ai를 통한 모든 처리는 전송 중 암호화되며, 처리 후 파일은 보관되지 않습니다. 추출된 데이터를 받는 스프레드시트는 세무 준비 작업 문서에 이미 적용하고 있는 것과 동일한 보안 관행으로 처리해야 합니다.
IRS는 AI로 추출된 데이터로 작성된 신고서를 수락하나요?
IRS는 데이터가 세무 신고 소프트웨어에 어떻게 입력되는지를 규제하지 않으며, 제출된 신고서가 정확하기만 하면 됩니다. 작성자가 신고 전에 추출된 값의 정확성을 검토하는 한, AI 추출을 데이터 입력 도구로 사용하는 것은 신고서의 유효성에 영향을 미치지 않습니다. 신고서에 기재된 작성자의 PTIN은 숫자가 소프트웨어에 어떻게 입력되었는지와 관계없이 동일한 전문적 책임을 수반합니다.
TaxWise, ATX 또는 CrossLink에서도 이 파이프라인을 사용할 수 있나요?
네, 가능합니다. 이 세금 신고 패키지는 모두 최소한 일부 신고 유형에 대해 Excel 또는 CSV 가져오기를 지원합니다. 파이프라인은 독점 형식이 아닌 구조화된 스프레드시트 데이터를 출력하므로 스프레드시트 가져오기를 지원하는 모든 소프트웨어에 적용할 수 있습니다. 각 양식 유형에 필요한 특정 열 매핑은 사용 중인 세무 소프트웨어의 가져오기 문서를 확인하세요.
성수기가 오기 전에 세금 시즌 파이프라인을 구축하세요
세금 시즌은 막판에 워크플로우를 바꾸는 것을 용납하지 않습니다. 문서 수집을 위한 Collection Link, 추출을 위한 Google Sheets 사이드바, 가져오기를 위한 기존 세무 소프트웨어로 구성된 이 파이프라인은 설정에 오후 하나, 검증에 테스트 신고 한 건이면 충분합니다. 그 후에는 모든 고객의 W-2 및 1099 데이터가 동일한 경로를 통해 흐르며, 신고 건마다 달라지는 것은 배치에 포함된 양식이 누구의 것인지뿐입니다.
이미 사용 중인 스프레드시트 레이어는 사라지지 않습니다. 이미 따르고 있는 가져오기 절차도 바뀌지 않습니다. 바뀌는 것은 셀이 채워지는 방식 — 그리고 2월을 Box 번호 입력으로 보낼지, 신고 검토로 보낼지입니다. 시즌에 200건을 처리하는 회사라면 그 차이는 미미한 수준이 아닙니다. 세금 시즌을 버티는 것과 운영하는 것의 차이입니다.
참고: 세무사가 W-2 및 1099 데이터를 Google Sheets로 옮기는 방법 — 추출 단계를 자세히 설명합니다. 수집 워크플로우는 Collection Link로 문서를 수집하는 방법을 읽어보세요. 비용 관련 맥락: 수동 W-2 및 1099 입력이 실제로 회사에 드는 비용.