韓国の取引明細書をExcelに抽出する方法

韓国では毎年6億件以上の電子税計算書がNTS電子税制システムを通じて処理されています。しかし、実際にすべての物理的な出荷に同梱される書類、すなわち取引明細書(거래명세서)は、デジタルの盲点に置かれています。法的に定められた形式はなく、政府のシステムに送信されることもありません。そして、20社の異なる供給者から週に40通を受け取る調達チームにとって、それぞれがPDF、印刷物、またはスマホの写真として届き、すべてレイアウトが異なり、同じ受領スプレッドシートに同じ明細レベルのデータを抽出する必要があります。

このガイドでは、韓国の取引明細書に実際に何が含まれているか、従来のOCRツールがなぜ苦戦するのか、そしてどの供給者の거래명세서からも明細データをExcelに抽出する方法を、供給者ごとの設定なしで一括処理で解説します。

手入力はもう不要 — AIに読ませましょう
画像またはPDFをアップロード — 10秒で構造化されたスプレッドシートデータに
今すぐ試す
登録不要 · クレジットカード不要 · 10秒で結果
調達照合用のExcelスプレッドシートへの韓国取引明細書データ抽出

重要なポイント

  1. 毎年6億件以上の電子税計算書が韓国のNTSシステムを流れていますが、実際に各出荷に同梱される거래명세서は、法的に定められた形式もデジタル送信経路もなく、そのシステムの完全に外側にあります。
  2. ボトルネックは韓国語の文字認識ではありません。法律が別のことを義務付けていないため、各供給者が独自のレイアウトを設計しています。テンプレートベースの抽出は一貫したフォーマットを前提としていますが、2社目の供給者から書類が届いた瞬間にその前提は崩れます。
  3. 単一の列定義(供給者名、品目名、数量、単価)があれば、位置ではなく意味によって任意の거래명세서を読み取れます。ImageToTable.aiは、供給者がどこに配置したかではなく、文書が何を言っているかを解読してフィールドを特定します。

韓国の取引明細書に実際に含まれるもの

取引明細書(거래명세서、文字通り「取引詳細文書」)は、韓国の企業間で商品とともに送付される文書です。税計算書(세금계산서)が韓国付加価値税法第32条に基づき法的に規制され、国税庁に送信される文書であるのに対し、거래명세서には必須形式がありません。これは私的証明文書(사적 증빙)であり、仕入税額控除の対象外で、政府機関への提出義務も法的要件もありません。法的に規制された韓国文書群(税計算書、現金領収書、証明書)については、韓国税文書抽出ハブで必須項目のある形式を扱っています。

この規制の空白が抽出問題を生み出します。標準形式が存在しないため、各供給者が独自のレイアウトを設計しています。仁川の包装資材供給者の取引明細書は、買い手情報を左上に、品目テーブルを中央下部に配置します。浦項の鉄鋼販売業者のものは、会社印(직인)をヘッダー全体に押し、品目行を横向きに配置します。どちらも間違いではありません。テンプレートがないため、間違いようがないのです。

一般的な거래명세서には以下の項目が含まれます:

項目韓国語名目的
供給者情報공급자事業者名、登録番号、住所、連絡先
供給を受ける者情報공급받는자受取事業者名、登録番号、住所
取引日付거래일자商品が納品された日付
品目名품목명納品された各品目の名称またはコード
規格규격寸法、型番、等級
数量수량納品された単位数
単価단가1単位あたりの価格
金額금액行合計(수량 × 단가)
供給価額공급가액全行金額の合計(付加価値税を除く)
税額세액付加価値税(供給価額の10%)
備考비고追加メモ — 納品条件、分割納品フラグ、発注書参照

この文書は通常、複写で発行されます。供給者用(공급자용)の赤い控えと、供給を受ける者用(공급받는자용)の青い控えです。調達ワークフローでは、物理的な納品とともに届きます。受領チームは、発注書と実際の商品と照合します。これは3ウェイマッチングと呼ばれるプロセスで、その後に届く税計算書に対する支払いを承認する前に行われます。

韓国のERPシステム、ECOUNT(이카운트)Douzone(더존)iQuestの얼마에요では、取引明細書は通常、販売記録から自動的に生成されます。これは送り側では解決済みの問題です。問題が発生するのは受け取り側です。これらのシステムには、仕入先から受け取る取引明細書のデータを取り込むネイティブな方法がありません。

テンプレートベースのツールが取引明細書(거래명세서)を処理できない理由

ほとんどの文書抽出ツールは、座標ベースのテンプレートか学習済みモデルのいずれかの原理で動作します。座標ベースのシステムでは、フィールドの周囲に矩形を描きます。「供給者名は(120, 340)にある」といった具合です。ツールはその領域に表示されたテキストを読み取ります。学習済みモデルのシステムでは、10〜50件のサンプル文書に注釈を付けて、各フィールドが通常どこに表示されるかをモデルに学習させます。

どちらのアプローチも、거래명세서では同じ理由で機能しません。「通常」というものが存在しないからです。この文書には標準レイアウトがないため、座標とフィールドの位置は仕入先ごとに異なります。仕入先Aの取引明細書でモデルを学習しても、仕入先Bの形式では失敗します。仕入先Bの形式を学習セットに追加すると、仕入先Cのレイアウトで新たな失敗モードが発生します。これはトレーニングデータの問題ではなく、テンプレートに依存した抽出と、そもそもテンプレートに依存するように設計されていない文書タイプとの間の構造的なミスマッチです。

その代替案がセマンティック抽出です。ツールにどこを見るかを指示するのではなく、何を探すかを指示します。「品目名」「数量」「単価」「供給価額」など、必要な列名を入力します。AIは文書を視覚的に読み取り、ページ上の位置ではなく意味を理解して各フィールドを特定します。列名抽出と呼ばれるこのアプローチでは、1つの列定義で、レイアウトや向き、供給者名が左上にあるか中央にあるかヘッダーブロックに埋め込まれているかに関係なく、すべての仕入先の取引明細書を処理できます。

この違いが重要なのは、その代替案である仕入先ごとに個別のテンプレートを維持する方法がスケールしないからです。仕入先が3社なら機能します。30社になると、テンプレートライブラリの維持自体が管理業務になります。列名抽出はその維持管理を完全に不要にします。同じ列定義が1社目の仕入先の文書でも30社目の文書でも機能します。

テンプレートベースのOCRは文書レイアウトが一貫していることを前提とします。列名抽出は一貫していないことを前提とします。そして、法的に定められた形式を持たない韓国のB2B文書にとって、それが正しい前提です。

ステップバイステップ:取引明細書(거래명세서)データをExcelに抽出する

取引明細書のPDFを受け取ってから、スプレッドシートに構造化データが入るまでの完全なワークフローは以下の通りです。各ステップは1つのアクションです。座標の描画、モデルのトレーニング、供給者ごとの設定は一切不要です。

1
取引明細書をアップロードします。 PDF、スキャン、写真をアップロードエリアにドラッグ&ドロップします。供給者からPDFがメールで届いたら、保存してアップロードします。配送ドライバーから紙のコピーを受け取ったら、スマートフォンで写真を撮って画像をアップロードします。JPG、PNG、WebP、PDFに対応しています。毎日のバッチ処理では、当日の配送分の明細書をすべて一度にアップロードします。
2
列を定義します。 スプレッドシートに抽出したいフィールド名を入力します。購買照合では、一般的な列セットは次のとおりです:供給者名、事業者登録番号(사업자등록번호)、取引日付(거래일자)、品目名(품목명)、規格(규격)、数量(수량)、単価(단가)、金額(금액)、供給価額(공급가액)、税額(세액)、発注書(PO)参照番号。入力した列名が、入力した順序でExcel出力の正確なヘッダーになります。
3
処理して確認します。 AIが各文書を読み取り、要求された各フィールドを(位置ではなく)意味的に特定し、出力テーブルに入力します。取引明細書の品目テーブルからの明細行は行ごとに抽出され、供給者名などのヘッダーレベルのフィールドは各行に繰り返されます。抽出されたデータを画面上で確認し、エクスポート前に必要に応じてセルを編集できます。
4
Excelとしてダウンロードします。 テーブル全体をXLSX、CSV、またはJSONでエクスポートします。各取引明細書の各品目行が、スプレッドシートの1行になります。ヘッダーフィールドはすべての行に入力されます。出力は、後処理なしで、ECOUNT、Douzone、またはカスタムシステムなど、ERPへのインポートにそのまま使用できます。

抽出エンジンは各フィールドを意味で読み取ります。事業者登録番号(사업자등록번호)はハイフン付きの10桁パターンで認識し、供給価額(공급가액)は数量と単価の列との相対的な位置で認識し、品目名(품목명)は品目テーブル内の文脈で認識します。これが、光学式文字認識とビジュアル言語理解の違いです。前者はテキストを読み取り、後者は文書を読み取ります。

このアプローチの背後にある仕組みの詳細については、列名による特定フィールドの抽出に関するガイドを参照してください。

JPG/PNG/PDF AI抽出

ファイルは安全に処理され、保存されることはありません。

手入力はもう不要 — AIに読ませましょう
画像やPDFをアップロード — 10秒で表計算データに変換
今すぐ試す
登録不要 · クレジットカード不要 · 10秒で結果

3ウェイマッチング:発注書(PO)と取引明細書(거래명세서)と税計算書(세금계산서)の照合

取引明細書から単独でデータを抽出することも有用ですが、調達照合サイクルの一部として抽出することで、真の業務効率化が実現します。韓国の標準的な調達ワークフローは、予測可能な順序で進みます:発注書(발주서)を供給者に送付 → 商品が取引明細書(거래명세서)とともに納品 → 検収を実施 → 税計算書(세금계산서)が発行されNTS(国税庁)に送信 → 支払いが行われます。

検収の場では、3ウェイマッチングが求められます:発注された内容(PO)、納品された内容(거래명세서)、請求された内容(세금계산서)を照合します。検収時に発見された不一致は電話一本で解決できますが、月末の照合時に発見された不一致は、納品記録、供給者メール、ERP画面を遡って確認するのに何時間もかかります。

照合に使用する各文書タイプのデータは以下のとおりです:

文書発行元照合の主要フィールド
発注書(발주서)自社ERP発注数量、合意単価、希望納期
取引明細書(거래명세서)供給者(紙/納品時のPDF)納品数量、品目名、明細書上の単価
税計算書(세금계산서)供給者(NTS電子税計算書経由)請求数量、請求単価、供給価額、税額、NTS承認番号

ボトルネックは中央の列です。取引明細書のデータはほぼデジタル化されていません。箱にクリップで留められた紙、または納品通知メールに添付されたPDFとして届きます。そのデータが、ERPからのPOデータやNTSシステムからの税計算書データと同じ形式のスプレッドシートになるまで、3ウェイマッチングを自動化することはできません。

取引明細書のデータがExcelに抽出されれば、計算列を使用して出力内で直接照合を行うことができます。差異:発注数量 vs 納品数量(PO数量 - 数量)のような列を定義すると、AIが抽出時にすべての明細行の差異を計算します。ゼロ以外の差異がある行は、スプレッドシートを開く前にフラグが立てられます。同じ抽出パイプラインで発注書を処理する場合は、POデータをExcelに抽出することもでき、両方の文書タイプを同じ構造化形式にして直接比較できます。

並行するシナリオとして、税計算書データの抽出に特化したガイド「韓国税計算書データのExcelへの抽出」では、7つの必須フィールドと四半期ごとの付加価値税申告ワークフローを解説しています。VAT申告用に大量の請求書を処理する場合は、バッチ税計算書処理ガイドで処理能力の面をカバーしています。

バッチ処理:日次取引明細書の処理

個別抽出は文書単位の問題を解決します。バッチ処理は日次ボリュームの問題を解決します — しかも、設定作業を一切繰り返す必要はありません。

上記ステップ2で作成した列定義は、文書固有のものではありません。必要なフィールドを記述するものであり、フィールドがどこに表示されるかを記述するものではありません。つまり、15社の異なる供給者からの20件の取引明細書 — すべてレイアウトが異なる — を1つのバッチでアップロードできます。同じ列定義がすべての文書に適用されます。出力は1つの統合スプレッドシートで、各明細書のすべての明細項目が1行ずつ占め、供給者名と日付が同じ文書のすべての行にわたって入力されます。

週に30件の取引明細書を受け取る調達チームは、手動データ入力の約3〜4時間を節約できます。調達担当者の推定時給KRW 18,000〜25,000で計算すると、単一のワークフロー変更だけで月額KRW 220,000〜400,000の節約になります。この数字には、削減されたエラー修正時間は含まれておらず、実際には入力時間と同等かそれ以上になることもあります。

紙の取引明細書と納品書を一貫して送ってくる供給者の場合、コレクションリンク(수집 링크)を使用すると、デジタル化ステップを上流に移行できます。共有可能なURLを生成し — 供給者のログインは不要 — 供給者オンボーディング手順に含めます。供給者はスマートフォンでリンクを開き、短い認証コードを入力し、取引明細書の写真またはPDFを処理キューに直接アップロードします。文書はすでにデジタル化された状態で届き、チームは再入力する代わりにデータを抽出します。これは、韓国領収書抽出ガイドで説明したのと同じ仕組みで、B2B調達の文脈に適応させたものです。

取引明細書を他の納品文書と一緒にバッチ処理する場合、抽出ワークフローは同じです — 列を一度定義し、すべてをアップロードし、1つのスプレッドシートをダウンロードします。納品書抽出ツールは、同じ荷物で取引明細書に同伴することが多い運送会社発行の納品伝票についても同じパターンをカバーしています。

よくある質問

取引先ごとに取引明細書のフォーマット設定が必要ですか?

いいえ。列名抽出は、位置ではなく意味でフィールドを特定します。同じ列定義(供給者名、品目名、数量、単価、供給価額)がすべての取引先のレイアウトで機能します。AIが文書を視覚的に読み取り、取引先がページ上のどこに配置したかに関係なく、各フィールドが何を表すかを理解するからです。

手書きの取引明細書も処理できますか?

はい、印刷されたテンプレート形式に手書きで記入されたものは処理可能です。これは韓国の物流で最も一般的な紙の形式で、取引先が白紙の거래명세서テンプレートを印刷し、数量や日付を手書きで記入します。印刷された構造がなく完全に手書きの文書はより難しく、精度は低くなります。システムは印鑑(직인)や署名を視覚要素として扱います。存在を検出することはできますが、そこからテキストを抽出することはありません。

供給価額(공급가액)と税額(세액)はどのように区別しますか?

AIは文書の意味的な階層を理解します。공급가액はVAT前の合計金額です。세액は通常、その金額の10%(韓国のVAT税率)です。両方の列を定義すると、AIはそれらの関係を利用して抽出を検証します。検出された공급가액の値が세액との期待される関係と一致しない場合、システムはフラグを立てます。VAT検証(세액 / 공급가액)のような計算列を定義して、各行の比率を出力することもできます。

Excelではなく、ECOUNTやDouzoneにデータを抽出できますか?

直接の出力形式はExcel(XLSX)、CSV、またはJSONです。ECOUNTとDouzoneはどちらも取引データのExcelインポートをサポートしています。XLSXとしてエクスポートし、お使いのERPのインポート機能を使用してデータを読み込んでください。Excel出力の列名は、お使いのERPのインポートフィールド名に合わせて設定できるため、マッピング作業を省くことができます。

韓国語と英語のフィールドが混在する文書はどうですか?

AIは両方の言語を読み取ります。多くの韓国の取引明細書には、特に輸入品や多国籍サプライチェーンの場合、韓国語の説明とともに英語の品目名が含まれています。出力に必要な言語で列を定義してください。AIはソース文書の言語に関係なく、対応する値を見つけ出します。

次のステップ

韓国のB2B文書インフラのギャップは発行側にはありません。ECOUNT、Douzone、NTS電子税計算書システムが税計算書を完全にデジタル化済みだからです。ギャップは受領側にあります。つまり、供給者から送られてくる、機械読み取りを想定していない文書です。取引明細書は、調達照合、入庫受領、支払い承認という、下流の財務チームが依存する3つのワークフローに関わるため、このギャップの中心に位置しています。

このギャップを埋めるために、供給者の文書発行方法を変える必要はありません。必要なのは、届いた文書を処理するチームの方法を変えることです。受領ログへの転記に8分かかっていた取引明細書も、数秒で抽出できます。同じ列定義が、明日届く別の供給者・別フォーマットの明細書にもそのまま使えます。

📮 contact email: [email protected]