CFDIデータ抽出:メキシコ電子請求書の完全ガイド

CFDIは読むための文書ではなく、正しく解読すべき税務記録です。2014年からSATが義務付けるメキシコの電子請求書システムでは、請求書はXMLファイルとして届き、36文字のUUID、ペアとなるRFC税務ID、税制(Régimen Fiscal)コード、そして取引タイプに応じて、実際の支払い・給与・通関データを含む1つ以上の構造化された補足情報(complemento)が付与されます。これをスプレッドシートに抽出するには、人間が読みやすいようにではなく、政府によるリアルタイム検証用に設計された文書構造を理解する必要があります。このガイドでは、6種類のCFDI文書タイプ、補足情報(complemento)システム、利用可能なすべての抽出方法、そしてメキシコのチームがすでに使用している会計ソフトウェアとの出力統合方法まで、全体像を網羅します。

手入力をやめよう — AIに読み取らせるだけ
画像やPDFをアップロード — 10秒で構造化データに
今すぐ試す →
ブログの表紙画像。タイトル「CFDIデータ抽出:メキシコ電子請求書の完全ガイド」が大きな濃紺のテキストで表示され、その下にXML法的請求書、SAT検証、全6種類のCFDIタイプを示す3つの小さなアイコンがあります。水色のグラデーション背景に、手描きのデータをテーマにした線の装飾が隅に描かれています

重要なポイント

  1. メキシコの仕入先請求書を処理するすべての買掛管理チームは、CFDI PDFからデータを抽出します。しかし、SATの規則では、PDFには法的効力は一切なく、XMLファイルのみが有効な文書です。
  2. 請求書ヘッダーだけで抽出を止め、補足情報(complemento)を無視すると、実際に必要なデータの約60%しか取得できません。Pagoの支払い詳細、Nóminaの給与明細、Comercio Exteriorの通関データは、ほとんどのチームが抽出しないXML追補文書に含まれています。
  3. フィールドの位置ではなくフィールドの意味で文書を読み取るセマンティック抽出ツールは、あらゆるPACからのCFDI PDF、XML、補足情報(complemento)を単一のワークフローで処理できます。8テンプレートの設定も、PACごとの設定も不要です。

CFDIが他の請求書と何が違うのか

濃い青で「XMLが請求書であり、PDFではない」というタイトルが書かれた情報グラフィック。その下にXML生成、PAC検証、SAT登録のステップを示す3つのアイコンが一列に並び、淡いグラデーション背景に手描きのライン装飾が施されている

米国、欧州、アジアのサプライヤーから受け取る請求書はすべて同じ基本パターンに従います。サプライヤーが文書を発行し、あなたがそれを受け取り、請求書番号、日付、金額、税額といったデータは文書自体に記載されています。文書が真実の源泉です。CFDIはこのモデルを完全に覆します。

CFDI(Comprobante Fiscal Digital por Internet)は、政府認定のPAC(Proveedor Autorizado de Certificación)による検証とスタンプが施されて初めて法的に有効となるXML文書です。これはクリアランスモデルと呼ばれます。発行者がXMLを生成してPACに提出し、PACが構造と電子署名を検証してデジタルスタンプ(timbre fiscal)を適用し、メキシコの税務当局であるSATにリアルタイムでコピーを転送します。この三者間のハンドシェイクが完了して初めて、請求書は法的文書として存在します。その時点でSATが割り当てるUUID(Folio Fiscal)は、その取引をその後のすべての監査、支払い、税務申告に結びつける恒久的な識別子となります。

これには、メキシコのサプライヤーを初めて扱うAPチームのほとんどが驚く実際的な結果があります。XMLファイルこそが法的に有効な請求書なのです。同じメールに添付されて届くPDFは装飾的な印刷物にすぎず、人間が確認するには便利ですが、法的な効力はありません。CFF第30条に基づき、発行者と受領者の両方が原本のCFDI XMLを少なくとも5年間保管する義務があります。PDFだけを残してXMLを破棄すると監査上のリスクが生じますが、多くのチームはSATが記録を要求して初めてそのことに気づきます。

現在のバージョンであるCFDI 4.0は、2023年4月から必須となっています。このバージョンでは受領者の検証が厳格化され、受領者のRFC、法的名称、税務上の住所の郵便番号がSATの納税者台帳と完全に一致する必要があります。バージョン3.3の請求書はもはや受け付けられません。CFDI抽出ワークフローを構築する場合、扱うすべての文書が4.0スキーマに従うことになります。これは抽出の一貫したターゲットですが、以前のバージョンより必須フィールドが多いことも意味します。

CFDI抽出における核心的な問題は、データが存在しないことではありません。データが政府のクリアランス用に設計された形式で存在し、スプレッドシートでの利用を想定していないことです。そして、その橋渡しこそが、多くのチームが構築に苦労する部分なのです。

6種類のCFDI文書タイプ — それぞれに遭遇する場面

CFDIは単一の文書タイプではありません。SATは6つの異なるcomprobanteタイプを定義しており、それぞれに独自のスキーマ規則、必須フィールド、抽出要件があります。メキシコのサプライヤー数社以上から請求書を処理する場合、そのほとんどに遭遇することになります。

タイプコード使用される場面抽出の複雑さ
IngresoI標準的な売上請求書 — 商品またはサービスの収入。受け取るCFDIの約85%を占めます。基本スキーマ。IVAの内訳、UsoCFDIが必須です。
EgresoEクレジットノート、返金、割引 — 以前発行されたIngreso請求書に対する減額。元のUUIDを参照する必要があります。文書間の照合が必要です。
PagoP支払い領収書 — PPD請求書が一部または全額決済された際に発行されます。高。支払いごとのUUID参照を含む補足情報(complemento)を伴います。
NóminaN給与領収書 — すべての従業員への支払いに必須。SATはこれを所得税と社会保障の照合に使用します。高。IMSS、INFONAVIT、SAR、その他の控除タイプを含む50以上のフィールドを持つ補足情報(complemento)。
TrasladoT移送文書 — 販売を伴わない商品の移動(在庫移動、委託、Carta Porte)。中。貨物輸送にはCarta Porte補足情報(complemento)が必要です。
RetencionesR源泉徴収文書 — 第三者への支払いに対する源泉徴収税(ISR、IVA)を報告します。別のXSDを使用します。基本CFDIスキーマの一部ではありません。
リスト形式のグラフィック。濃紺のタイトル「6 CFDI Document Types You'll Encounter」、その下に2x3のグリッドでIngreso、Egreso、Pago、Nómina、Traslado、Retencionesの文書タイプを番号付きで列挙。薄い青灰色の背景に幾何学的な装飾

実際に抽出で最も摩擦が生じるのはPagoです。仕入先がPPD支払条件で請求書を発行する場合、請求書自体には明細項目と合計額が含まれますが、支払詳細は含まれません。買い手が支払いを行うたびに、仕入先は別のPago CFDIを発行し、その中にComplemento de Pagoが含まれます。これには、どのUUIDが支払われたか、金額、日付、支払方法が指定されています。買掛金チームが40件のPPD請求書を処理する場合、60〜80件のCFDIを照合する必要があり、それぞれについてIngresoとその支払補足情報(complemento)の間でUUIDの相互参照が必要です。複数の仕入先からの50件以上の請求書にわたるこの照合を処理する月次決算のステップバイステップのワークフローについては、買掛金におけるメキシコCFDI請求書のバッチ処理に関するガイドをご覧ください。

主要フィールド、SATカタログ、およびスプレッドシートへの影響

どのフィールドを抽出するかを理解することは、単なる技術的な問題ではありません。DIOT申告、IVAクレジットの照合、監査対応に出力が使用できるかどうかを左右します。CFDIのすべてのフィールドはSATカタログコードに対応しており、同じフィールドでも選択されたコードによって税務上の影響が異なる場合があります。

ヘッダーレベルのフィールド(Comprobanteノード)

フィールドXPath(簡略化)重要性
UUID(税務伝票番号)/cfdi:Comprobante/Complemento/TimbreFiscalDigital/UUID全取引の主キー。支払照合、取消追跡、監査証跡に使用。
発行者/受取人 RFC/cfdi:Comprobante/Emisor/@Rfc, /Receptor/@Rfc双方の納税者番号。1文字の誤りで経費の税額控除が無効に。
税制区分(発行者)/cfdi:Comprobante/Emisor/@RegimenFiscal供給者に適用される税法を決定。個人 vs 法人、RESICO vs 一般制度。
発行日/cfdi:Comprobante/@FechaISO 8601形式のタイムスタンプ。SATが税務期間の割り当てに使用。
シリーズ + 連番/cfdi:Comprobante/@Serie, @Folio供給者内部の請求書番号。供給者明細との照合に有用。
小計 / 合計/cfdi:Comprobante/@SubTotal, @Total税抜金額と最終金額。合計 = 小計 + 転嫁IVA − 源泉IVA。
通貨 + 為替レート/cfdi:Comprobante/@Moneda, @TipoCambio通貨コード(MXN、USD、EUR)とメキシコペソ以外の場合の為替レート。
支払方法 / 支払形態/cfdi:Comprobante/@MetodoPago, @FormaPagoPUE(一括)vs PPD(分割)。支払補足文書の要否を決定。
CFDI用途/cfdi:Comprobante/@UsoCFDI受取人の用途コード。G01(取得)、G03(経費)、D01(自動車)、P01(PPD)。IVA控除資格に影響。
輸出区分/cfdi:Comprobante/@ExportacionCFDI 4.0必須項目。01=国内、02=確定輸出。DIOT報告用に請求書を区分。

税の内訳:IVA、Retenciones、IEPS

CFDIの税構造は、品目(明細項目)レベルの下、各Concepto内にネストされています。つまり、IVA税率と金額は明細項目ごとに設定され、請求書レベルの集計ではありません。出力で請求書ごとに単一の税行が必要な場合は抽出時に合計する必要がありますが、基盤となるデータは詳細レベルです:

  • IVA 16% — ほとんどの商品とサービスに適用される標準税率。国境地域(北部および南部フロンティア)は、特定の条件下で軽減された8%のIVA税率の対象となります。
  • IVA 0% — 輸出(Exportación=02/03)および特定の基礎食品、医薬品、農業用品に適用されます。
  • IVA Retenido — 受取人はIVAの3分の2を源泉徴収し、SATに直接納付する必要がある場合があります。CFDIにはImpuestosTrasladados(仕入先が請求するIVA)とImpuestosRetenidos(買い手が源泉徴収するIVA)の両方が表示されます。
  • ISR Retenido — 個人(persona física)が提供するサービスに対する10%の源泉徴収、一般制度からの購入に対する1.67%、利息支払いに対する20%。これらは毎月のDIOTで報告する必要があります。
  • IEPS — アルコール、タバコ、ガソリン、清涼飲料水などの特定商品に対する物品税。各製品カテゴリは異なるIEPS税率(3%〜160%)に対応します。

抽出において重要な点は、1つのCFDIに異なる明細項目にわたって複数の税の組み合わせを含めることができることです。標準商品(IVA 16%)とIEPS対象製品の両方を販売する販売業者からの単一の請求書には、16%、16%+IEPS、場合によっては0%の項目が含まれます。抽出出力では、明細レベルの税詳細を保持するか、税率ごとに正しく集計する必要があります。

補足情報(complemento)レイヤー:ほとんどの抽出ガイドがここで止まっています

PPD請求書:支払いデータがありません」というタイトルの2カラム比較グラフィック。左の列はIngreso CFDIで赤いXと「支払いデータなし」、右の列はPago CFDIで緑のチェックマークと「支払い+UUID参照」、薄いグレーの背景に幾何学模様の装飾

補足情報(complemento)とは、特定の取引タイプ向けに基本CFDIスキーマを拡張する、構造化されたXML付属文書です。基本CFDIは請求書ヘッダーと明細行をカバーします。それ以外のすべて — 支払い詳細、給与明細、通関データ、輸送情報 — は補足情報(complemento)に含まれます。メキシコの請求書を処理するAPチームにとって、最も重要な補足情報(complemento)は3つです。

支払い補足情報(Complemento de Pago)

すべてのPago CFDIに添付されるこの補足情報は、実際のメキシコのAP処理において、抽出の複雑さの最大の要因です。仕入先がPPD条件(MétodoPago=PPD)で請求書を発行する場合、元のIngreso請求書には支払いデータが含まれません。買い手が支払うたびに — 全額、分割、または繰延条件のいずれであっても — 仕入先はPago CFDIを発行し、その支払い補足情報(Complemento de Pago)には以下が記録されます:

  • 支払い対象となる元のIngreso請求書のUUID
  • そのUUIDに適用された支払い金額
  • 支払い日と支払い方法(振込、小切手、現金、カード)
  • 支払い時の通貨と為替レート(元の請求書がUSDの場合に重要)
  • この支払い後の未払残高(saldo insoluto)

1つのIngreso請求書が、複数のPago CFDIで決済される場合があります — それぞれが同じUUIDを参照しつつ、異なる支払い金額を持つことになります。抽出の課題は技術的なものではなく(UUIDは常に存在します)、手続き上のものです:ほとんどのAPチームは支払い補足情報(Complemento de Pago)をまったく抽出せず、支払いデータを元の請求書に接続するワークフローが何もない別の文書に残したままにしています。

請求書ヘッダーで止まり、補足情報(complemento)に触れないCFDI明細抽出では、APチームが実際に必要とするデータの約60%しか取得できません。

Complemento de Nómina(給与補足情報)

メキシコの雇用主は、給与、賞与、歩合、休暇プレミアム、退職金、クリスマスボーナス(aguinaldo)など、従業員へのすべての支払いに対してNómina CFDIを発行する必要があります。Complemento de NóminaはCFDIシステムの中でも最もフィールド数の多い文書の1つで、以下のような50以上の構造化フィールドを含みます:

  • 従業員のCURPおよびIMSS社会保険番号
  • 基本給および日給(Salario Base de Cotización)
  • 種類コード別に分類された通常収入(percepciones)— Sueldos、Aguinaldo、Prima Vacacional、PTU
  • 控除(deducciones)— 源泉徴収されたISR、IMSS拠出金、INFONAVITローン返済、SAR/Afore、年金ローン
  • 時間外労働時間(Horas Extra)— 時間区分と割合付き
  • 正味支払総額

複数事業体の雇用主にとって、給与抽出とは、各給与サイクルごとに数百件のNómina CFDIを処理することを意味します。各従業員は支払いごとに1つのCFDIを生成し、それぞれの補足情報(complemento)フィールドをHRまたは給与報告用スプレッドシートにフラット化する必要があります。

Complemento de Comercio Exterior(外国貿易補足情報)

Exportación=02(A1税関キーによる確定輸出)またはExportación=03(A2キーによる確定輸出)の場合に必須です。この補足情報(complemento)は、国境を越える取引の税関側データを保持します:

  • ペディメント(pedimento)番号(税関申告ID)
  • 輸出者のRFCおよび完全な住所
  • 受取人の外国税ID
  • INCOTERMコード
  • 明細ごとの詳細:関税分類(fracción arancelaria)、税関単位、商品のUSD価値
  • 原産国および仕向国

この補足情報(complemento)のバージョン2.0は、2024年1月からCFDI 4.0に統合されています。メキシコから商品を輸出する企業にとって、基本CFDIフィールドと外国貿易補足情報データの両方を抽出することは、運送請求書と税関申告書の照合に不可欠です。

PACによってPDFレイアウトが異なる理由

すべてのCFDIは同じXMLスキーマ(SATが公開するXSDで定義されたAnexo 20バージョン4.0)から始まります。XMLは、どのPACがスタンプを押しても一貫しています。しかし、多くのAPチームが実際に目にするPDF表現は、各PACがXMLを視覚形式にレンダリングする方法に完全に依存しています。

実際には、FinkokがスタンプしたCFDI PDFは、SW sapien、Digifact、FacturAPI、またはSAT自身の無料ツールがスタンプしたものとは、フィールドの視覚的な順序が異なります。データは同一です。レイアウトは異なります。固定位置の抽出ゾーンに依存するテンプレートベースのOCRツールでは、PACレイアウトごとに個別のテンプレートが必要です。20社のサプライヤーから請求書を受け取り、それらが合計で8つの異なるPACを使用している場合、8つの抽出テンプレートが必要になり、まだ設定していない9番目のPACからの請求書は見逃してしまうでしょう。

ここで、セマンティック抽出(各フィールドがどこにあるかではなく、何を意味するかを理解してドキュメントを読み取るAI)が、CFDI処理の経済性を変えます。UUIDとRFCの違いを認識できるセマンティック抽出ツールは、PACがフィールドをページの上部、左、右、下部、または枠線付きボックスの内側のどこに配置しても、両方のフィールドを見つけることができます。PACのレイアウトは無関係になり、単一の抽出設定でポートフォリオ内のすべてのサプライヤーとすべてのPACをカバーできます。

抽出方法の比較:CFDIワークフローに適したアプローチは?

チームによって、ドキュメント量、形式の混在、技術力、予算に基づいて、CFDI抽出に異なるアプローチを選択します。次の表は、メキシコの請求書処理にとって重要な側面に対して、4つの主要な方法をマッピングしたものです。

項目手動入力XML解析(スクリプト)テンプレートOCRAI意味抽出
セットアップ時間不要1~3日(スクリプト作成・テスト)PACレイアウトごとに1~2時間約15分
全PACレイアウト対応可(目視)不可(XML処理)不可(レイアウトごとにテンプレートが必要)可(レイアウト非依存)
スキャン・写真対応可不可一部可(品質低下で精度低下)可
補完書類対応ユーザーが確認すれば可可(スクリプト作成時)不可(PDFに補完書類なし)可(両方のソース処理可能な場合)
CFDI 50件あたりの時間約3~4時間約2分(一括処理)約15分+修正約2~5分
エラー率(フィールド単位)約3~5%(誤字・転記ミス)約1%(スキーマ不一致)約8~15%(レイアウト不一致)約1~3%
必要な技術スキル不要Python/XPath/XML中程度(ゾーン設定)不要
月500件以上の拡張性❌✅⚠️✅

XML解析とAIセマンティック抽出の選択は、必ずしも単純ではありません。すべてのサプライヤーが生のCFDI XMLを送信し、チームにスクリプト作成能力がある場合、XPathやPythonのlxmlなどのライブラリを使用したXML解析は、構造化データからクリーンで直接的なフィールド抽出を生成します。制限は、XML解析がスキャンされた請求書を読み取れないこと、XMLが添付されていない場合に視覚的なPDF表現を解釈できないこと、そしてSATがスキーマを更新したとき(3.3→4.0移行で発生したように)に積極的なメンテナンスが必要になることです。

対照的に、AIセマンティック抽出は、PDF、スキャン画像、スマートフォン写真など、あらゆる視覚ドキュメントから機能し、構造化されたXML入力を必要としません。数千の請求書レイアウトでトレーニングされた最新のビジョンモデルは、それらのラベルが何を意味するかを理解することで、ドキュメント内のどこに表示されるかに関係なく、UUID、RFC、IVAフィールドを見つけることができます。XMLなしのPDF添付ファイルとスキャン文書の両方を受け取るチームにとって、これは唯一のスケーラブルなオプションです。

JPG/PNG/PDF AI抽出 XML対応

ファイルは安全に処理され、保存されることはありません。実際のCFDI PDFまたはXMLでお試しください。

AI抽出がCFDI文書を処理する仕組み — 3つの形式すべてに対応

多くのAPチームにとって最も現実的なシナリオは、異なるPACを使用するさまざまなサプライヤーから、XMLファイル、PDF添付ファイル、スキャン文書が混在して届くことです。形式ごとに個別のワークフローを構築すると、メンテナンスの負担が増え、処理の抜け漏れが生じます。3つすべてを入力ソースとして扱い、単一のフィールド定義で処理するAI抽出アプローチにより、この問題は大幅に簡素化されます。

ImageToTable.aiは、カスタム列抽出パラダイムを通じてCFDI抽出を処理します。出力に必要な列を定義すると、AIはフィールドがページ上のどこにあるかではなく、フィールドの意味を理解して各値を特定します。CFDIの場合、ワークフローは次のとおりです。

1
アップロード — CFDIのPDF、XMLファイル、または写真をアップロードキューにドロップします。1回の操作で50件以上の文書を一括アップロードできます。
2
列を定義 — 必要なフィールド名を入力します:UUID(Folio Fiscal)、RFC Emisor、RFC Receptor、SubTotal、IVA Tasa、IVA Monto、Total、UsoCFDI、MétodoPago、Moneda。PPD請求書の場合は、UUID PagadoとMonto del Pagoを追加して、補足情報(complemento)のPagoフィールドを取得します。
3
処理 — AIがバッチ内の全文書からフィールドを抽出します。XMLファイルはXML構造から直接読み取り、PDFやスキャン画像はビジョンベースの意味理解を使用します。XMLフィールドはAnexo 20スキーマから直接解析され、PDFおよび画像フィールドは意味的マッチングによって視覚的に特定されます。米国の請求書で請求書番号を読み取るのと同じAIが、CFDIのUUIDやRFCも読み取ります。
4
エクスポート — 統合された出力をExcel、CSV、またはJSONとしてダウンロードします。すべてのサプライヤー、すべてのPAC、すべてのフォーマットが、一貫した列ヘッダーを持つ単一のスプレッドシートに集約されます。各行が1つのCFDI、各列が定義した1つのフィールドです。

このアプローチにより、PACのレイアウト問題は自動的に解決されます。AIはフィールドが固定位置にあることに依存しないため、FinkokがレンダリングしたCFDI(UUIDが2ページ目の右上隅にある)も、FacturAPIがレンダリングしたCFDI(UUIDが左下のフッターにある)も、同じ構造化出力を生成します。

特に補足情報(complemento)の抽出について、XMLファイルを直接処理する場合、AIは階層構造をナビゲートできます。Pago CFDIの/Complemento/Pagosノードから参照されたUUID、支払金額、日付を抽出します。同じPago CFDIのPDF表現の場合、AIはPACが視覚文書に表示した場所から補足情報(complemento)フィールドを読み取ります。

CFDIデータとメキシコ会計ソフトの連携

抽出したCFDIデータは、経理チームが実際に使用するシステムに届いて初めて役立ちます。メキシコの会計ソフトウェア環境は米国や欧州とは大きく異なり、主要な製品は国産で、それぞれに固有のデータインポート要件があります。

CONTPAQi

CONTPAQiはメキシコで最も広く使われている会計・業務管理スイートで、会計(Contabilidad)、電子請求書(Factura Electrónica)、給与(Nóminas)、営業(Comercial)をカバーします。CONTPAQiはCFDI XMLを検証用にネイティブインポートできますが、大量データ分析(仕入先請求書200件と予算コードの照合、UsoCFDIカテゴリ別の支出レポート作成、DIOT入力データ準備)には、CONTPAQiの勘定科目表に対応するExcel形式のデータが必要です。抽出されたRFC、UUID、IVA額などの列は、一括仕訳としてインポートすると、CONTPAQiの補助元帳に直接反映されます。

Aspel SAE / COI / NOI

Aspelはメキシコの中小企業で2番目に多い会計プラットフォームで、SAE(業務管理)、COI(会計)、NOI(給与)のモジュールがあります。CONTPAQiと同様に、Aspelは個別請求書検証用にCFDI XMLを処理できますが、レポート機能を最大限活用するには、Aspelのインポートテンプレートに合わせたExcelテーブルにCFDIデータを事前にまとめる必要があります。メキシコの経理担当者の間では、補助的なCFDI台帳をExcelで管理するのが一般的です(1行=1請求書、RFC、UUID、伝票番号、IVA率、源泉徴収額の列)。これをAspelの元帳と毎月照合します。自動抽出により、この補助台帳は手作業での入力から直接エクスポートへと変わります。

SAPおよびOracle NetSuite

メキシコで事業を展開する大企業は通常、CFDIコンプライアンスに対応したローカライズ版のSAPまたはOracle NetSuiteを利用しています。これらのシステムは、組み込みのCFDIモジュールを通じてXML検証とPAC送信を自動的に処理します。しかし、課題はコンプライアンスから照合に移ります。購買部門と買掛金部門は、抽出されたCFDIデータを発注書、入荷伝票、仕入先契約条件と照合する必要があります。UUID、RFC、明細品目コード(c_ClaveProdServ)、税額明細を含む構造化された行としてCFDIデータを出力するAI抽出ワークフローは、SAPのMIRO(物流請求書検証)やNetSuiteの買掛金一括インポート処理に直接取り込めます。

よくある質問

AIはCFDI XMLファイルからデータを抽出できますか?

はい。最新のAI抽出ツールはCFDI XMLファイルを直接解析し、Anexo 20スキーマの構造化フィールドを読み取ることができます。すべてのフィールドにXPathクエリが必要な純粋なXML解析スクリプトとは異なり、AIベースの抽出はスキーマのバリエーションを処理し、ソースがXML、PDF、スキャン画像のいずれであっても、定義した同じ列構造にデータを出力できます。これは、一部のサプライヤーがXML添付ファイルを送信し、他のサプライヤーがPDFを送信するハイブリッドバッチで特に有用です。

DIOT申告のためにCFDIから抽出すべきフィールドは?

毎月のDIOT(第三者取引情報申告書)には、最低限以下が必要です:サプライヤーのRFC、UUID、SubTotal、IVA(税率別内訳 — 16%、8%、0%)、源泉徴収IVA、源泉徴収ISR、UsoCFDI。DIOTではIVAを税率レベルで報告する必要があるため、抽出出力では単一の合計ではなく、税率コードごとにIVAを分離する必要があります。Exportaciónフィールドは取引が国内か輸出かを決定します — DIOTではこれらのカテゴリを分けて報告します。

PDFのみ入手可能な場合、PPD請求書をどう処理すればよいですか?

元のIngreso CFDIがPPDで発行され、PDFのみしかない場合、請求書データ(明細、合計、IVA)はPDFから読み取れますが、支払詳細は読み取れません — これらは別途発行されるPago CFDIに含まれています。支払い照合を完了するには、元のXMLファイルまたはPago CFDIのPDFが必要です。PDF請求書とPago CFDI文書の両方を処理するAI抽出ツールは、Complemento de Pagoフィールドの列を含めれば、支払UUIDの相互参照を一度のステップで出力できます。

CFDI抽出は異なるPACのPDFレイアウトを自動的に処理しますか?

テンプレートベースのOCRツールでは、PACレイアウトごとに個別のテンプレートが必要です — Finkok、SW sapien、Digifact、FacturAPI、SATの無料ツールは、同じXMLデータから視覚的に異なるPDFを生成します。フィールドの位置ではなく意味を理解して文書を読み取るAIセマンティック抽出ツールは、PACごとの設定なしですべてのPACレイアウトを自動的に処理します。FinkokスタンプのCFDIで機能する抽出設定は、他のPACでスタンプされたものにもそのまま機能します。

PDF表現は抽出目的で法的に有効ですか?

APワークフローや照合目的では、PDFからのデータ抽出で実務上十分です。PDFにはXMLと同じ請求書データが含まれています。ただし、メキシコ税法(CFF第30条)では、XMLのみが法的に有効な文書です。監査保存のためには、日常的なデータ抽出にどの形式を使用する場合でも、元のXMLファイルを保持する必要があります。実用的なワークフローとしては、受領した形式(最も一般的なPDF)から抽出しつつ、NOM-151-SCFI-2016に基づく法定保存期間5年間、XMLを構造化リポジトリにアーカイブすることをお勧めします。

同じツールでNómina(給与)CFDIからデータを抽出できますか?

はい、抽出ツールが給与明細に表示される内容と一致するフィールドレベルの列名をサポートしていれば可能です。Complemento de Nóminaには、総収入、総控除、源泉所得税(ISR)、IMSS、INFONAVIT、個別の所得・控除タイプコードなど、50以上のフィールドがあります。文書を意味的に読み取るAIツールは、必要な給与データポイントに合わせて列に名前を付ければ、これらのフィールドを抽出できます。ただし、手書きの給与記録よりも印刷されたNómina PDFの方が精度は高く、またNómina補完の階層構造(例:Percepciones/Percepcion/TipoPercepcionのような深くネストされたフィールド)では、視覚的なPDF版よりもXML版の方が一般的に信頼性の高い結果が得られます。

CFDIが取消された場合、再抽出が必要ですか?

CFDIの取消は受領者同意モデルに従います。仕入先が請求書を取り消す場合(理由コード01~04)、受領者は72時間以内に取消を承諾または拒否する必要があります。承諾された場合、元のCFDIは無効となり、代替品が発行された場合(理由コード01)は新しいUUIDが割り当てられます。抽出ワークフローはこのライフサイクルを処理する必要があります。具体的には、データベースで取消済みUUIDにフラグを立てて代替品をインポートするか、SATの取消フィードを確認して更新される「CFDIステータス」列(有効/取消)を維持します。処理履歴を保持する自動抽出ツールは、代替CFDIを再取り込みし、元のものを置き換え済みとしてフラグ付けできますが、これには元のXMLまたは以前に抽出されたUUIDの永続的なデータベースが必要です。

出力のComplemento de Pagoフィールドはどう扱えばよいですか?

Complemento de Pagoフィールド(参照UUID、支払金額、支払日、未収残高)は、Ingreso請求書データと同じスプレッドシートに抽出する必要があります。推奨される方法は、バッチ出力に追加の列として含めることです。PPD請求書の場合、抽出では基本請求書データとPago CFDIの支払いフィールドの両方が返されます。その後、VLOOKUP(または同等の関数)を使用してPago UUID参照を元のIngreso UUIDと照合し、完全に決済された請求書と未処理の請求書を確認できます。これにより、毎月のCFDI照合で最も時間がかかる手動の相互参照手順が不要になります。

「CFDI文書を持っている」と「会計システムにデータがある」の間にあるギャップは、技術的なものではなく、フォーマット変換のギャップです。適切な抽出ワークフローを使えば、そのギャップは数時間ではなく数分で埋まります。

CFDIデータ抽出は、根本的に難しいものではありません。XMLは構造化されており、PDFにも同じデータが含まれています。補足情報(complemento)はSATが公開するXSDに文書化されています。実際に難しいのは、フォーマットの多様性、PACレイアウトのばらつき、税務・補足情報データの階層的な入れ子構造、そしてほとんどの抽出ワークフローが毎回同じ見た目のフラットな位置ベースの文書向けに設計されていることです。セマンティックなアプローチ、つまり各フィールドが何であるかを理解して文書を読み取る方法(どこにあるかではなく)は、単一のフィールド定義でこれらすべての複雑さを処理します。列を定義すれば、AIがデータを見つけ出し、フォーマットは無関係になります。

現在メキシコの仕入先請求書を処理していて、データを活用するよりも文書間でのデータ移動に多くの時間を費やしているなら、次のステップは明確です。サンプルバッチ(どのような形式でも10〜20件のCFDIファイル)を用意し、AI抽出ワークフローにかけてみてください。「文書を持っている」と「スプレッドシートにデータがある」の間のギャップは、手作業のプロセスで感じるほど大きくはありません。

手入力をやめよう — AIに読み取らせるだけ
画像やPDFをアップロード — 10秒で構造化データに
今すぐ試す →

この記事は、請求書データ抽出に関するImageToTable.aiガイドシリーズの一部です。より広範な概要については、請求書データ抽出とは?およびOCRとは?をご覧ください。CFDIの初心者向け入門記事は、CFDIとは?をお読みください。各CFDI形式を網羅した実践的なステップバイステップの抽出チュートリアルは、メキシコCFDI請求書データのExcelへの抽出をご覧ください。CFDI処理が従来のAPワークフローを困難にする理由について詳しくは、メキシコのCFDI請求書処理が多くのチームの想定より難しい理由をお読みください。

📮 contact email: [email protected]