メールパーサー

メッセージ全体、本文、PDF添付ファイルを読み取り、フィールドをスプレッドシートの列として取り込むAI メールパーサー

各メールを手動で開き、添付ファイルをダウンロードし、そのフィールドをスプレッドシートに入力する作業は、1ドキュメントあたり約3分かかります。このツールは本文と添付ファイルを5〜10秒で解析します。

1ページあたり5〜10秒 · 印刷テキストで最大99%の精度 · 専用受信トレイアドレス · 送信者ごとのルール不要

あらゆるメールボックスから転送
PDF添付ファイルを読み取り
専用受信トレイアドレス
XLSX / CSV / スプレッドシート

メールパーサーが各メッセージと添付ファイルから抽出する内容

メールパーサーは、構造化されていないメッセージをスプレッドシートの行に変換します。ImageToTable.ai はメッセージの両方の部分をカバーします。すべてのツールが確認できるヘッダーフィールド(送信者、件名、受信日)と、通常は添付ファイル内にあるデータです。ビジョンモデルが、アップロードされたドキュメントを読み取るのと同じ方法で、PDF、スキャン、写真を読み取ります。列名を入力すると、転送された各メールがそれらのヘッダーを持つ行として登録されます。

送信者アドレス / 名前
件名
受信日
請求書 / 注文番号
発注番号
請求日
支払期限 / 支払条件
合計金額
通貨
取引先 / 会社名
明細項目(添付ファイルから)
追跡番号

これらは列名の例です。本文フィールドはメッセージ自体から取得され、明細項目や合計などのフィールドはPDFまたは画像の添付ファイルから読み取られます。列のセットは一度定義するだけで、転送されたすべてのメールが同じ構造の行を生成します。

データは通常、メール本文にはなく、添付ファイルの中にある

このクエリで上位表示されるツールのほとんどは、メッセージの文章を読み取ってそこで止まるメールパーサーです。その設計はメール自体がドキュメントだった時代には理にかなっていましたが、請求書、注文確認書、銀行通知の場合、メッセージはPDFを包む封筒にすぎません。そこから3つの構造的な問題が生じ、多くの解析設定が静かに劣化していく理由を説明しています。

本文テキスト解析の限界

01

本文のみのパーサーは、データが始まるところで止まってしまう。 注文確認メールは、4ページのPDF請求書を囲む2文の散文である。本文パーサーは散文、件名、そして本文中に記載された合計金額を取得する。しかし、請求書番号、明細項目、税額の内訳は、開かれることのない添付ファイルの中にある。このカテゴリのGmailおよびSheetsアドオンは、「定型メール」を解析するものであり、添付されたドキュメントを解析するものではない。

02

解析ルールは1つの送信者のレイアウトに紐付けられており、ベンダー自身のドキュメントもそれを認めている。 cloudHQのセットアップガイドでは、すべてのメッセージが「類似した形式」である必要があるため、単一の送信者と件名にフィルタリングするよう指示されている。Mailparserのヘルプセンターも、「テキスト内の固定位置」を中心に各ルールを構築することを推奨している。ベンダーが「Total」を「Amount Due」に変更したり、テンプレートを変更したりすると、ルールはエラーを出さない。間違った範囲を取得するか、何も取得しないかのどちらかである。

03

メールのノイズが位置ベースのルールを無効化する。 署名ブロック、法的免責事項、引用された返信チェーンにより、「Total:」の後のテキストが1つのメッセージに3回出現することがあり、最も古いコピーは通常、引用されたスレッド内にある。r/ConnectWiseの解析ルールに関するスレッドでは、次のように明確に述べられている: 「解析ルールの問題は、常に使用できるとは限らず、メールの件名に依存することだ」

列名抽出がどのように処理するか

01

添付ファイルはドキュメントとして読み取られ、スキップされません。 ビジョンモデルは、直接アップロードされたファイルと同じ方法でPDF、スキャン、写真を読み取り、印刷テキストに対して最大99%の精度を実現します。パスワード保護された添付ファイルにも対応しています。設定でよく使うパスワードを保存しておくと、暗号化されたPDFは処理前に自動的に試行されます。本文フィールドと添付フィールドは1つの行にまとめられます。

02

列は一度定義するだけで、どの送信者にも対応できます。 これはカスタム列抽出です。必要な列名(請求書番号、支払期日、合計金額など)を入力すると、AIが値の位置ではなく意味を理解して各値を特定します。新しい送信者や、メールを再設計した既存の送信者でも、再設定は一切不要です。また、各アカウントには専用の受信トレイアドレスが1つ割り当てられるため、ルールベースのツールのようにレイアウトごとにメールボックスを管理する代わりに、すべてを1か所に転送するだけで済みます。

03

意味に基づく読み取りは、メールの装飾に影響されません。 署名、免責事項、引用されたスレッドテキストは、フィールド値と混同されません。抽出は位置ではなく意味に基づいて実行されるため、「合計」という単語を含む免責事項は合計金額として扱われません。転送されたチェーンに同じ数値の古いバージョンが含まれている場合でも、bboxハイライト付きのレビューモードで、抽出された各値がどの出現箇所から取得されたかを正確に確認できるため、再読込ではなく一目で検証できます。

これら3つの問題の背後にあるパターンは同じです。ルールベースのメール解析は、送信者ごと、レイアウト変更ごとに新しい作業を発生させます。セマンティック抽出はスキーマを一度だけ設定し、送信者を吸収します。

メールクライアントを開かずに、仕入先メールをスプレッドシートの行へ

メールで届く仕入先請求書を処理する場合、メッセージの受信からエクスポートまでの一連の流れは次のとおりです。

1

専用インボックスアドレスに転送

すべてのアカウントにインボックスアドレスが1つ付与されます。サプライヤーと共有するか、ご自身のメールボックスに転送ルールを設定して、請求書が自動的に届くようにします。送信者ホワイトリストを有効にすると、キューに関係のないメールが混入しなくなります。自動処理をオンにすると、メールが届いた瞬間に抽出が開始され、次のステップで定義した列テンプレートが使用されます。添付ファイルは自動的に処理キューに追加されるため、ダウンロードや再アップロードは不要です。

1つのアドレス、どのメールボックスでも、アップロード不要。

2

列名を一度だけ設定

必要なフィールドを入力します:SenderInvoice NumberInvoice DateDue DateTotal、さらに明細項目などの添付ファイル側のフィールドも追加できます。これらの名前がそのまま出力スプレッドシートのヘッダーになります。列セットをテンプレートとして保存すると、自動処理が毎回それを再利用します。AIが各メッセージと添付ファイルを読み取り、入力可能なすべての列を埋めます。特定のメールに含まれていないフィールドは推測せず、空のままにします。

列名がそのまま出力になります。送信者ごとのルールは不要。

3

バッチをエクスポート

各メールが1行になり、本文フィールドと添付ファイルフィールドが並んで表示されます。バッチをXLSX、CSV、JSONとしてエクスポートするか、アドオンを通じて結果を直接Google Sheetsに出力できます。日付と金額は抽出時に標準化されるため、クリーンアップ作業なしでAPやレポートのワークフローにそのまま使用できるファイルが得られます。

送信者請求書番号支払期日合計
[email protected]INV-882132026-09-30$4,218.60
[email protected]VP-104272026-10-07$1,102.00

値の例です。送信者はメッセージヘッダーから取得され、その他は添付された請求書PDFから取得されます。

このメールパーサーが得意なことと、意図的に行わないこと

メールの内容と添付ファイルを列に解析することは範囲が限定された作業であり、その上にワークフローを構築する前に、境界線がどこにあるのかを正確に把握しておく価値があります。

最適なケース

実際の内容がPDFまたは画像の添付ファイルであるメール。 請求書、発注書、銀行明細書、納品書は通常、添付ファイルとして届く。添付ファイルは完全なドキュメントとして解析されるため、明細項目や合計金額は、添付メモだけでなく、そのまま保持される。

ホワイトリストに登録できる定期的な送信者。 自動処理とバインドされたテンプレートを有効にすると、クリックなしでメール到着時に抽出が開始される。アドレスをベンダーやクライアントと共有している場合、ホワイトリスト登録によりキューをクリーンに保てる。

送信者が混在し、形式が変動する場合。 1つの受信トレイアドレスと1つの列セットで全送信者をカバーできるため、ベンダーがメールを再設計したり、新しいサプライヤーが加わったりしても、メンテナンス作業は発生しない。

注意が必要な場合

列を生成するものであり、バックオフィス業務を代行するものではありません。 このツールは、メールの本文と添付ファイルを構造化データに変換します。返信の送信、メールボックスのルール管理、ベンダーへの不足項目の問い合わせ、CRMや会計システムの代替は行いません。変換後のスプレッドシートをどう活用するかは、ご自身のワークフロー次第です。

添付ファイルの品質は依然として重要です。 デジタル生成のPDFは、画面の写真よりもはるかに確実に抽出できます。人間が添付ファイル上の項目を読み取るのに目を細める必要がある場合、モデルも同様に苦労する可能性が高く、手書きや著しく劣化したスキャン文書は確認プロセスを経ることをお勧めします。

長い転送チェーンは、確認のための目視が推奨されます。 抽出は意味に基づいて行われますが、同じ数値の古いバージョンを複数引用しているチェーンは、値の出所を確認するのに30秒かける価値がある唯一のシナリオです。bboxハイライト付きのレビューモードは、まさにこの目的のために存在します。

よくある質問

どのメールボックスから自動転送できますか?Gmail、Outlook、Zohoのメールパーサー設定はありますか?

転送をサポートするメールボックスであればどれでも動作します。パーサーがメールボックスにログインすることはないためです。すべてのImageToTable.aiアカウントには専用の受信アドレスが1つ付与されるため、gmail email parser、outlook email parser、zoho email parserなどの検索はすべて同じ設定にたどり着きます。Gmail、Outlook、Zoho Mail、その他のクライアントで、そのアドレスにメッセージを送信する転送ルールを設定するだけです。パーサーは転送されたものだけを参照し、送信者ホワイトリストによって無関係な送信者はキューから除外されます。メールを解析するものであり、テキストメッセージは対象外です。SMS転送はこのツールの機能範囲外です。

添付ファイルも読み取りますか、それともメール本文のみですか?

両方です。そして通常、添付ファイルの方が重要です。本文テキストのみを解析するパーサーは、散文と件名で止まってしまいますが、請求書メールの場合、請求書番号、明細項目、合計金額はPDF添付ファイル内にあります。ImageToTable.aiは、アップロードされたPDFやスキャン文書を読み取るのと同じ方法で、ビジョンモデルを使って添付ファイルをドキュメントとして読み取り、本文フィールド(送信者、件名、受信日)と添付ファイルフィールド(請求書番号、明細項目、合計金額)を同じスプレッドシートの行に配置します。

ベンダーがメールの形式を変更した場合はどうなりますか?

何も壊れません。送信者ごとのルールがないためです。テンプレートベースのパーサーは、各フィールドを特定の送信者のレイアウト内の固定位置またはラベルに結び付けているため、ラベル名が変更されたりテンプレートが再構成されたりすると、誤った値または何も返されません。ここでは出力列を一度定義するだけで、AIが意味に基づいて各値を特定するため、新しい送信者や再設計されたメールでも再設定は不要です。設定を変更する必要があるのは、これまで抽出していなかったフィールドを取得したい場合のみで、その場合もルールの修復ではなく列の追加で対応します。

PDF添付ファイルから請求書番号や合計金額を自動的にExcelに取り込めますか?

はい。必要な列(請求書番号、請求日、支払期日、合計金額)を定義し、テンプレートにバインドして、受信トレイの自動処理を有効にします。請求書PDFが添付された転送メールは、誰もメッセージを開かなくてもスプレッドシートの行になります。パスワード保護された添付ファイルにも対応しています。事前に設定で使用するパスワードを保存しておくと、処理前に暗号化されたPDFが自動的に試行されます。結果はXLSX、CSV、JSONとしてエクスポートするか、アドオンを通じてGoogleスプレッドシートに直接出力できます。

無料のメールパーサーからExcelへのトライアルはありますか?

はい。登録は無料で、自分のメールでテストできるクレジットが含まれています。添付ファイル付きのサンプルメッセージを転送して、列が埋まるのを確認し、支払い前に出力を評価できます。このページのライブデモはアカウントなしでも動作します。有料プランは無料クレジットを使い切った後、月額$9から始まります。

メール駆動型の抽出に関するワークフローの詳細はこちら:

📮 contact email: [email protected]