サプライヤー技術仕様の比較に
日数がかかる理由
2社のサプライヤーが同じポンプを提示しています。あるデータシートには「定格出力: 7.5 kW」と記載され、別のものには「モーター: 10 hp」と記載されています。3社目は筐体に「AISI 304」と記載し、4社目は「EN 1.4301」と記載しています。これらの書類に矛盾はありません。同じ仕様を4つの異なる表現で説明しているだけであり、1行でも評価する前に、担当者が4つの表現が同じ意味であることを手作業で証明する必要があります。
この変換作業こそが、入札比較の時間を奪う原因です。比較表の各行は、それぞれが少しずつ異なる表現で書かれた書類から組み立てられており、手作業での整合が最も時間のかかる部分です。

重要ポイント
- 入札比較を遅らせるのは読解ではなく、4つの表現で書かれた同じ仕様が1つの意味であることを証明する作業です。
- 5社・80行の入札では、400のセルそれぞれに表現の判断が必要であり、1つ見落とすことは統計的にほぼ確実です。
- 抽出と判断を分離する: 書類を読む前に1つの列セットを定義し、各サプライヤーの元の表現を正規化した値の横に保持することで、比較を監査可能な計算式にできます。
同じ仕様が、4つの異なる書き方で表現される

サプライヤーが仕様をわざと異なる表現にしているわけではありません。彼らは自社の地域や業界で定められた方法で表現しているだけです。米国のバイヤーはグレード304ステンレス鋼をAISI 304と書きます。欧州の加工業者はEN 1.4301と書きます。日本のサプライヤーはSUS 304と書きます。3つとも同じ合金を、3つの異なる国家規格に基づいて表しており、すべて正しい表現です。
このパターンは、ほぼすべての技術カテゴリーで繰り返されます。10馬力のモーターは7.5 kWモーターと同じです。IEC 60529でIP55と評価された筐体は、北米のサプライヤーによってNEMA Type 12筐体と表現されることがあり、この2つの評価は重なる部分があっても完全に同一ではありません。あるデータシートには「最高使用温度」と記載され、別のものには「熱的限界」、さらに別のものには「使用温度範囲」と記載されます。24か月の保証は「2年間の保証」と同じ約束です。
これらはすべて、要件を記載する正当な方法です。問題が生じるのは、それらが同じ入札書類に並んだ瞬間です。比較するには、EN 1.4301とAISI 304が同じ行に属すること、馬力とキロワットが同じ単位であること、熱的限界が使用温度であることを、誰かが判断しなければなりません。そうした判断こそが比較そのものです。手作業のプロセスでは、それらの判断は人の頭の中で暗黙のうちに行われ、レビュー担当者が確認できる場所には一切残りません。
サプライヤー入札の比較が失敗するのは、サプライヤーが意見を異にするからではありません。異なる言葉で同じことを述べているのに、その変換が誰にも見えない場所で行われてしまうからです。
入札仕様書の比較が通常どのように行われるか
適切に運営された評価は2つの段階で進み、その順序が重要です。まず適合性チェックが行われます。各入札は必須要件に対してチェックされ、合格か不合格かのいずれかになります。そのゲートを通過した入札のみが技術評価に進み、品質、性能、安全性、またはライフサイクルコストが重み付けされた基準に対して評価されます。価格の商業評価は技術評価の後に行われるため、安価な入札が非適合の入札を静かに上回ることはできません。
英国調達・供給協会(CIPS)は、このプロセスの実務者向けバージョンを定めています。技術評価は評価チームの技術メンバーによって実施され、サプライヤーが提供する代替案は個別に評価されなければならず、チームはすべての入札を同じ方法で扱い、開始から終了まで明確で文書化された監査証跡を保持することが期待されます。重み付けスコアリングは、各基準のスコアにその重みを掛け、結果を正規化して入札をランク付けできるようにします。
公共部門の調達には、さらに別の義務の層が加わります。英国政府の2023年調達法に基づく技術仕様書に関するガイダンスは、買い手とサプライヤーが「要件の共通理解」を共有できるようにするために存在します。仕様書は、品質、性能、安全性、寸法、梱包、およびラベル表示を記述します。それらは曖昧さのないように書かれています。比較とは、その意図が、複数のサプライヤーがそれぞれ独自の言葉で同じ要件に回答するという現実に直面する場です。
紙面上では、その仕組みは健全に見えます。要件リスト、スコアリングモデル、サプライヤーごとに1列あるマトリックス。しかし、その図が隠しているのは、その下にある準備作業です。誰かが依然として各文書を読み、マトリックスに入力する必要があり、それがプロセス文書がほとんど説明しないステップです。手動の見積比較に潜む欠陥は、まさにこの点にあります。マトリックスは、判断があたかもデータであるかのように提示するのです。
どこで問題が起きるか:変換は抽出の内部で発生する

2つの別々の作業が1つの動作にまとめられており、そこから失敗が始まります。 買い手がサプライヤーのデータシートを読み、比較シートに値を入力するとき、2つの別々の操作が同時に行われます。1つ目は抽出です。定格出力を見つけて読み取ることです。2つ目は正規化です。この値がマトリックスのこの行の基準に一致するかどうかを判断することです。タイピングは機械的に見えますが、後半は判断が必要であり、前半に埋もれているため、痕跡が残りません。
そのため、後からエラーを発見するのが難しくなります。完成したマトリックスのセルには単一の数値が入っており、その数値は、担当者が等価性の確認に30秒かけた場合でも、列ヘッダーが十分に近いように見えたため想定した場合でも、見た目は同じです。シートを引き継いだレビュー担当者にはデータが見えます。作成した人は、その過程で数十の文書化されていない意味上の判断を行っています。
単位が問題をさらに複雑にします。あるサプライヤーがキログラムで見積もり、別のサプライヤーがポンドで見積もる場合、あるいは週単位と日単位で見積もる場合、誰かが換算を行います。通常はラベルのない補助列か暗算で行います。小数点を1つ間違えるだけで行全体が歪み、その歪みがスコアに影響します。定格や規格にも同じことが当てはまります。IP定格とNEMAタイプは関連していますが、互換性はなく、それらを同義語として扱うと、実際のコンプライアンス上の差異が静かに見落とされる可能性があります。
実務者はまさにこの言葉で作業を説明しています。r/procurementのスレッドで、ある買い手は次のように書いています:「技術入札を評価するとき、長い技術仕様書と複数のサプライヤー提案を手動で比較しなければならないことがよくあります。要件を1行ずつ照合し、同じ基準に対して異なる表現を解釈することになります。時間がかかり、反復的で、不適合や利点を見逃しやすいのです。」
手動での比較を当初の見た目よりも悪くする要因がさらに2つあります。重要な仕様は技術的な付録、脚注、または別の文書に隠れていることが多いため、比較は読者がたまたま正しい場所を見たかどうかに依存します。また、サプライヤーが値を完全に省略した場合、その空白は空のセルとして記録され、忘れられがちですが、欠落した値は行の中で最も有用なシグナルであることがよくあります。
APQCのオープンスタンダードベンチマーキングによると、1件の購買発注の処理コストは$14〜$54で、中央値は$42であり、そのコストの大部分はタイピングではなく調整です。マトリックスに手動で変換されるすべての仕様は、その数字の一部であり、すべてのサプライヤーとすべての明細項目で繰り返されます。
この計算で、なぜ時間がこれほど積み重なるのかが説明できます。5社のサプライヤーと80項目の技術明細を含む中規模の評価では、400セルになります。各セルには少なくとも1つの文言判断が必要で、難しいセルでは複数回の判断が必要です。この規模では、エラーは注意力の問題ではありません。統計的に確実に発生するものであり、プロセスには400の判断のうちどれが誤りだったかを特定する方法がありません。
解決策:意味に基づいて埋める、単一の正規化された列セット

解決策は、サプライヤーの文書を読む前に比較の列を決定し、すべての文書をその固定されたセットに抽出することです。各データシートに独自のラベルや単位を決めさせるのではなく、正規化された基準を一度だけ書き出します:材質グレード、定格出力(kW)、筐体保護等級、動作温度範囲、保証期間(か月)、認証ステータス。すべてのサプライヤーが同じ行構造を埋めるため、サプライヤーごとに1行、基準ごとに1列になります。
これがカスタム列抽出の仕組みです。テンプレート上のフィールドに枠を描くのではなく、必要な列名を入力すると、AIがページ上の位置ではなくフィールドの意味を理解して各値を特定します。入力した列名が出力テーブルのヘッダーになります。段落の途中にモーター定格を記載しているデータシートも、仕様表に記載しているデータシートも、同じ列に収まります。
文言の不一致は推論列で処理されます。推論列は、文書があなたの言葉を一切使用していない場合でも、AIに定義したカテゴリへ値を配置するよう求めます。列を材質グレード(選択肢:304ステンレス / 316ステンレス / その他)と定義すると、サプライヤーの「EN 1.4301」は「304ステンレス」として入力されます。規格(選択肢:AISI / EN / JIS / その他)などの2番目の列を追加して、サプライヤーの元の文言を正規化された値の横に保持し、依存している等価性が暗黙的ではなく可視化されるようにします。
技術入札の実用的な正規化セットは、次のようになります:
| 定義する列 | サプライヤーが記入する可能性のある値 | 正規化後の値 |
|---|---|---|
| 材料グレード(選択肢: 304 / 316 / その他) | EN 1.4301、AISI 304、SUS 304 | 304ステンレス |
| 規格(選択肢: AISI / EN / JIS / その他) | EN 1.4301準拠 | EN |
| 定格出力(kW) | 10 hp | 7.5 |
| 筐体保護等級(選択肢: IP55 / IP65 / NEMA 12 / その他) | IEC 60529に基づくIP 55 | IP55 |
| 保証期間(か月) | 2年間保証 | 24 |
| 保守スケジュールの記載(あり / なし) | (付属書に保守項目なし) | なし |
同じ列セットをすべてのドキュメントに適用するため、抽出自体がバッチ処理になります。すべてのサプライヤーファイルを一度にアップロードすると、サプライヤーごとに1行ずつ並んだ単一のテーブルが得られます。個々のファイルを開いてマトリックスに入力する必要はありません。これまで人が読みながら入力する過程で暗黙的に行われていた整合が、列と選択肢リストを備えた明確なステップとして実行されるようになります。
まず正規化した列セットを書く
要件リストを、単位を含んだ列名に変換します。例:定格出力(kW)、保証期間(か月)、筐体保護等級(選択肢:IP55 / IP65 / NEMA 12 / その他)。ターゲット構造を明確にすることが、手作業プロセスで担当者の頭の中で行われているステップです。
元の表現用にソース列を追加する
各正規化値の隣に、ソース規格列と生のメモ列を保持します。レビュアーが「EN 1.4301がなぜ304ステンレスになったのか」と質問したとき、その答えは購入担当者の記憶ではなく隣のセルにあります。
全サプライヤーを1つのバッチで抽出する
全サプライヤーの仕様書、データシート、技術付属書をまとめてアップロードします。各ドキュメントが同じテーブルの1行になるため、あるサプライヤーのPDFも別のサプライヤーの撮影された付属書も、同じ構造で取り込まれます。
推論列で語彙を正規化する
各推論列の選択肢リストが変換を行います。馬力はキロワットに、AISI 304は標準グレードになり、欠落した認証は空白セルに消えるのではなく「記載なし」と記録されます。
シート上で意図的に並べて比較する
サプライヤーごとに1行あれば、実際の比較はスプレッドシートの操作になります。並べ替え、フィルター、重み付けの適用、しきい値を外れた値に数式でフラグを立てる。判断は目に見える操作になり、データ入力に埋もれた仮定ではなくなります。
もう1つの機能が単位の問題をきれいに解決します。計算列は抽出中に計算を実行し、その結果を新しい列として出力します。また、ドキュメントに一切登場しない固定係数を参照できます。あるサプライヤーが馬力で、他のサプライヤーがキロワットで見積もった場合、Rated Power (kW from hp)として定義された列は、そのサプライヤーに0.7457の換算を適用するため、比較前に列内のすべての値がすでに1つの単位に統一されます。
この種のドキュメントに関するより広いワークフローは、ベンダー見積書抽出の完全ガイドで説明されており、比較シートの作成方法はExcelで比較するための見積データ抽出で詳しく解説しています。サプライヤー数が多い場合は、見積書を1つの比較表にバッチ抽出する方法が、ファイル数が多くなっても対応できるバージョンです。
ファイルは安全に処理され、保存されることはありません。
これが抽出であり、自動比較ではない理由
この境界線を正確にしておくことは重要です。なぜなら、ここが多くの仕様比較の主張が過大になるポイントだからです。 ImageToTable.aiは、各サプライヤーの仕様を1つの正規化されたテーブルに抽出します。2つのサプライヤー文書を読み取り、2つの表現が同等であると独自に判断することはありません。サプライヤーBが適合し、サプライヤーCが適合しないという判定を下すこともありません。その判断は評価チームに委ねられており、それが技術評価のステップの目的です。
この区別は、機能を装った制限ではありません。自動的な同等性の判定は、サプライヤーが落札に異議を申し立てたときに最も防御が難しいブラックボックスです。正規化されたすべての値が元の表現の隣に表示され、比較が誰でも読める計算式であるテーブルは、同じスピードを提供しつつ、レビュー担当者が追跡できる証跡を残します。手動とAI支援の比較におけるワークフローの違いは、まさにこの点にあります。ツールは転記を排除し、判断を可視化し続けるのです。
抽出と判断は別の作業です。これらを1つの動作で行うと仮定が隠され、分離することで比較が監査可能になります。
本ツールが対応しないこと
同等性の判断は行いません。カテゴリと選択肢リストはお客様が定義し、AIがそれらを埋めて元の文言を記録します。サプライヤーの仕様が本当に曖昧な場合、判断は依然として人が行う必要があり、ソース列によってその判断を検証可能にします。
サプライヤーが省略した仕様を発明することはできません。データシートに動作温度が記載されていない場合、セルは空のままです。そのギャップは有益な情報であり、モデルに推測させるのではなく、サプライヤーに確認することが答えです。「記載なし」などの推論列により、省略が黙って欠落するのではなく、可視化されます。
文章形式や手書きの付属文書は処理が困難です。印刷された仕様表が最も確実に抽出できます。このツールはPDF、スキャン、JPG、PNG、WebP、AVIF形式の写真も読み取ります。印刷された表データに対する最大99%の精度は、その特定の入力タイプに対する当社の数値であり、密集した手書きや品質の低いスキャンに対する保証ではありません。レビューモードとBbox検証はまさにこのために存在します。抽出された値にホバーすると、ソース領域が元のドキュメント上でハイライトされ、コンプライアンス上の重要度を持つフィールドをスポットチェックできます。
評価システムになるわけではありません。重み付けスコアリングエンジン、承認ルーティング、ERPへの書き戻しはありません。正規化されたテーブルは、お客様が既に実行している評価への入力です。それを支えるドキュメントタイプについては、フィールドとワークフローは発注書抽出ガイドと発注書からExcelへの変換例で説明されています。最終的なスコアリングには依然として技術担当者が必要です。CIPSは、技術評価がチームの技術メンバーに属することを明確にしています。ツールが排除するのは転記作業であり、専門知識ではありません。
よくある質問
ImageToTable.aiは2つのサプライヤー仕様を比較して、一致するかどうかを教えてくれますか?
いいえ、その境界は意図的なものです。各サプライヤーの仕様を1つの正規化されたテーブルに抽出し、サプライヤーごとに1行を割り当てます。表現が異なる2つの仕様が同等かどうかの判断はドキュメント間の判断であり、それは引き続き、確認・監査可能なスプレッドシートのステップとして残ります。各値が列になれば、横並びの比較は並べ替え、フィルタリング、数式で行えます。
異なる単位で記載された同じ仕様をどう扱えばよいですか?
抽出時に正規化します。あるサプライヤーが馬力を、別のサプライヤーがキロワットを記載している場合、計算列で固定の換算係数(1 hp = 0.7457 kW)を適用することで、列内のすべての値が1つの単位に統一されます。同じ方法は、インチとミリメートル、ポンドとキログラム、週と日にも適用できます。
サプライヤーが同じ機能に異なる名称を使用している場合はどうすればよいですか?
それが推論列の役割です。固定の選択肢セット(例:材料グレード(選択肢:304ステンレス / 316ステンレス / その他))を持つ列を定義すると、AIがサプライヤーの「EN 1.4301」という記載を、ドキュメントがあなたの用語を使用していなくても正しいカテゴリに分類します。対応するソース標準列には、サプライヤー自身の表現がそのまま保持されます。
スキャンや手書きの仕様書付録を読み取れますか?
PDF、スキャン、JPG、PNG、WebP、AVIF形式のスマートフォン写真がすべてサポートされています。鮮明な印刷テーブルが最も確実に抽出できます。手書きが濃い場合や、傾きや影のあるスキャンは精度が低下します。正規化されたテーブルが評価判断の基礎となる前に、レビューモードでサンプルを確認してください。
サプライヤーはポータルやテンプレートを通じて提出する必要がありますか?
いいえ。サプライヤーは従来どおり、PDF、スプレッドシート、スキャンしたフォームで仕様書を送り続けます。正規化は抽出時にあなたの側で行われるため、すべてのサプライヤーがプロセスを変更する必要はありません。
正規化されたテーブルは監査証跡になりますか?
これは各ドキュメントが記載した内容の構造化された記録であり、正規化された値とソースの表現が並べて表示され、レビューモードでは抽出された任意の値を元の領域に遡って確認できます。これはコンプライアンスの公式記録ではありません。元のドキュメントをテーブルと一緒に保管し、比較を可能にするインデックスとして扱ってください。
判断を記録に戻す
4社のサプライヤーが1つの仕様を4つの異なる表現で記載し、その変換はレビュー担当者が到達できない場所で行われました。その変換に固定の列セット、サプライヤーごとの1行、そして各正規化値の横にソース列を設ければ、判断は本来あるべき場所に戻ります。評価チームの前に、記録として、防御できる状態で。