Koreanische Transaktionsaufstellungen
in Excel extrahieren
Südkorea verarbeitet jährlich über 600 Millionen elektronische Steuerrechnungen über das NTS-e-Tax-System. Doch das Dokument, das tatsächlich jeder physischen Lieferung beiliegt – die Transaktionsaufstellung (거래명세서) – befindet sich in einem digitalen toten Winkel. Es hat kein gesetzlich vorgeschriebenes Format. Es wird an kein staatliches System übermittelt. Und für das Einkaufsteam, das 40 davon pro Woche von 20 verschiedenen Lieferanten erhält, kommt jede als PDF, Ausdruck oder Handyfoto – alle mit unterschiedlichen Layouts, alle mit denselben positionsbezogenen Daten, die in dieselbe Eingangs-Tabelle extrahiert werden müssen.
Dieser Leitfaden erklärt, was eine koreanische Transaktionsaufstellung tatsächlich enthält, warum herkömmliche OCR-Tools daran scheitern und wie Sie Positionsdaten aus jeder beliebigen 거래명세서 in Excel extrahieren – in einem Durchgang, ohne Einrichtung pro Lieferant.
Wichtigste Erkenntnisse
- 600 Millionen elektronische Steuerrechnungen fließen jährlich durch das NTS-System Koreas – aber die 거래명세서, die Sie tatsächlich mit jeder Lieferung erhalten, liegt vollständig außerhalb dieses Systems, ohne gesetzlich vorgeschriebenes Format und ohne digitalen Übertragungsweg.
- Der Engpass ist nicht die koreanische Zeichenerkennung. Jeder Lieferant gestaltet sein eigenes Layout, weil kein Gesetz etwas anderes vorschreibt. Vorlagenbasierte Extraktion setzt einheitliche Formatierung voraus – diese Annahme bricht, sobald ein zweiter Lieferant Ihnen ein Dokument sendet.
- Eine einzige Spaltendefinition – Lieferant (공급자), Artikelbezeichnung (품목명), Menge (수량), Stückpreis (단가) – liest jede 거래명세서 nach Bedeutung, nicht nach Position. ImageToTable.ai lokalisiert Felder, indem es dekodiert, was das Dokument aussagt, statt sich darauf zu verlassen, wo ein Lieferant Dinge platziert hat.
Was eine koreanische Transaktionsaufstellung tatsächlich enthält
Eine Transaktionsaufstellung (거래명세서, wörtlich „Transaktionsdetail-Dokument") ist das Dokument, das einer Lieferung zwischen koreanischen Unternehmen beiliegt. Im Gegensatz zu einer Steuerrechnung (세금계산서), einem gesetzlich regulierten Dokument gemäß Artikel 32 des koreanischen Mehrwertsteuergesetzes, das an die Nationale Steuerbehörde übermittelt wird, hat eine 거래명세서 kein verbindliches Format. Sie ist ein privates Verifikationsdokument (사적 증빙) — nicht zum Vorsteuerabzug berechtigt, keiner Behörde gemeldet und gesetzlich nicht vorgeschrieben. Für die gesetzlich regulierte Seite der koreanischen Dokumentfamilie — Steuerrechnungen, Kassenbons und Zertifikate — finden Sie in unserem Hub zur Extraktion koreanischer Steuerdokumente die Formate mit Pflichtfeldern.
Diese regulatorische Lücke verursacht das Extraktionsproblem. Da kein Standardformat existiert, gestaltet jeder Lieferant sein eigenes Layout. Eine Transaktionsaufstellung eines Verpackungslieferanten in Incheon platziert die Käuferinformationen oben links und die Artikeltabelle unten mittig. Eine von einem Stahlhändler in Pohang setzt den Firmenstempel (직인) über den Kopfbereich und die Artikelzeilen im Querformat. Keines ist falsch — denn es gibt keine Vorlage, gegen die man verstoßen könnte.
Eine typische 거래명세서 enthält folgende Felder:
| Feld | Koreanischer Name | Zweck |
|---|---|---|
| Lieferanteninformationen | 공급자 | Firmenname, Registrierungsnummer, Adresse, Kontakt |
| Empfängerinformationen | 공급받는자 | Firmenname des Empfängers, Registrierungsnummer, Adresse |
| Transaktionsdatum | 거래일자 | Datum der Warenlieferung |
| Artikelbezeichnung | 품목명 | Name oder Code jedes gelieferten Artikels |
| Spezifikation | 규격 | Abmessungen, Modellnummern, Qualität |
| Menge | 수량 | Anzahl der gelieferten Einheiten |
| Stückpreis | 단가 | Preis pro Einheit |
| Betrag | 금액 | Zeilensumme (수량 × 단가) |
| Nettowarenwert | 공급가액 | Summe aller Zeilenbeträge ohne Mehrwertsteuer |
| Steuerbetrag | 세액 | Mehrwertsteuer (10 % des Nettowarenwerts) |
| Bemerkungen | 비고 | Zusätzliche Hinweise — Lieferbedingungen, Teillieferungskennzeichen, Bestellreferenz (PO) |
Das Dokument wird in der Regel in zweifacher Ausfertigung erstellt: eine rote Kopie für den Lieferanten (공급자용) und eine blaue Kopie für den Empfänger (공급받는자용). Im Beschaffungsworkflow trifft es mit der physischen Lieferung ein. Das empfangende Team prüft es gegen die Bestellung und die tatsächlichen Waren — ein Prozess namens 3-Wege-Abgleich — bevor die Zahlung gegen die später folgende Steuerrechnung freigegeben wird.
In koreanischen ERP-Systemen wie ECOUNT (이카운트), Douzone (더존) und iQuests 얼마에요 werden Transaktionsaufstellungen (거래명세서) in der Regel automatisch aus Verkaufsbelegen erzeugt — ein gelöstes Problem auf der Ausgangsseite. Auf der Eingangsseite scheitert es jedoch: Diese Systeme bieten keine native Möglichkeit, Daten aus den Transaktionsaufstellungen zu übernehmen, die Sie von Ihren eigenen Lieferanten erhalten.
Warum vorlagenbasierte Tools Transaktionsaufstellungen (거래명세서) nicht verarbeiten können
Die meisten Dokumentextraktionstools arbeiten nach einem von zwei Prinzipien: koordinatenbasierte Vorlagen oder trainierte Modelle. Bei einem koordinatenbasierten System zeichnen Sie Rechtecke um Felder — „Lieferantenname bei (120, 340)“ — und das Tool liest den Text, der in diesem Bereich erscheint. Bei einem trainierten Modell annotieren Sie 10 bis 50 Beispieldokumente, damit das Modell lernt, wo jedes Feld üblicherweise erscheint.
Beide Ansätze scheitern bei 거래명세서 aus demselben Grund: Es gibt kein „üblicherweise“. Da das Dokument kein Standardlayout hat, unterscheiden sich Koordinaten und Feldpositionen bei jedem Lieferanten. Trainieren Sie ein Modell mit Transaktionsaufstellungen von Lieferant A, und es wird beim Format von Lieferant B versagen. Fügen Sie das Format von Lieferant B zum Trainingssatz hinzu, und das Layout von Lieferant C führt zu einer neuen Fehlerquelle. Das ist kein Trainingsdatenproblem — es ist eine strukturelle Diskrepanz zwischen vorlagenbasierter Extraktion und einem Dokumenttyp, der nie für Vorlagen gedacht war.
Die Alternative ist die semantische Extraktion: Statt dem Tool zu sagen, wo es suchen soll, sagen Sie ihm, wonach es suchen soll. Sie geben die gewünschten Spaltennamen ein — „Artikelbezeichnung“, „Menge“, „Stückpreis“, „Nettowarenwert“ — und die KI liest das Dokument visuell, indem sie jedes Feld über seine Bedeutung lokalisiert, nicht über seine Position auf der Seite. Dieser Ansatz, die sogenannte Spaltennamenextraktion, bedeutet, dass eine Spaltendefinition die Transaktionsaufstellung jedes Lieferanten verarbeitet — unabhängig von Layout, Ausrichtung oder ob der Lieferantenname oben links, zentriert oder in einem Kopfblock eingebettet ist.
Dieser Unterschied ist wichtig, weil die Alternative — eine separate Vorlage für jeden Lieferanten zu pflegen — nicht skaliert. Bei 3 Lieferanten funktioniert es. Bei 30 wird die Pflege der Vorlagenbibliothek zur eigenen Verwaltungsaufgabe. Die Spaltennamenextraktion umgeht diese Wartung vollständig: Dieselbe Spaltendefinition funktioniert beim Dokument des ersten und des 30. Lieferanten.
Vorlagenbasierte OCR setzt konsistente Dokumentlayouts voraus. Die Spaltennamenextraktion geht davon aus, dass sie es nicht sind — und das ist die richtige Annahme für jedes koreanische B2B-Dokument ohne gesetzlich vorgeschriebenes Format.
Schritt für Schritt: Transaktionsaufstellung-Daten in Excel extrahieren
Hier ist der vollständige Arbeitsablauf, vom Erhalt einer Transaktionsaufstellung als PDF bis zu strukturierten Daten in einer Tabellenkalkulation. Jeder Schritt ist eine Aktion — kein Koordinatenzeichnen, kein Modelltraining, keine Konfiguration pro Lieferant erforderlich.
Die Extraktions-Engine liest jedes Feld anhand seiner Bedeutung — sie erkennt eine Unternehmensregistrierungsnummer (사업자등록번호) an ihrem 10-stelligen Muster mit Bindestrichen, einen Nettowarenwert (공급가액) an seiner Position relativ zu den Spalten Menge und Stückpreis und eine Artikelbezeichnung (품목명) an ihrem Kontext in der Artikeltabelle. Dies ist der Unterschied zwischen optischer Zeichenerkennung und visuellem Sprachverständnis: Das eine liest Text; das andere liest Dokumente.
Für einen tieferen Einblick in die Mechanik dieses Ansatzes, siehe unseren Leitfaden zum Extrahieren bestimmter Felder nach Spaltenname.
Dateien werden sicher verarbeitet und nicht gespeichert.
3-Wege-Abgleich: Bestellung (PO) vs. Transaktionsaufstellung (거래명세서) vs. Steuerrechnung (세금계산서)
Das Extrahieren von Daten aus einer Transaktionsaufstellung für sich genommen ist nützlich. Die eigentliche operative Hebelwirkung liegt jedoch darin, sie als Teil des Beschaffungsabgleichszyklus zu extrahieren. Der standardmäßige koreanische Beschaffungsablauf folgt einer vorhersehbaren Reihenfolge: Bestellung (발주서) wird an den Lieferanten gesendet → Waren werden mit einer Transaktionsaufstellung (거래명세서) geliefert → Wareneingangsprüfung wird durchgeführt → eine Steuerrechnung (세금계산서) wird ausgestellt und an das NTS übermittelt → Zahlung erfolgt.
Am Wareneingang besteht die Aufgabe im 3-Wege-Abgleich: dem Vergleich von Bestelltem (PO), Geliefertem (거래명세서) und In Rechnung Gestelltem (세금계산서). Abweichungen, die am Wareneingang erkannt werden, kosten einen Telefonanruf. Abweichungen, die erst beim Monatsabschluss entdeckt werden, kosten Stunden der Rückverfolgung durch Lieferaufzeichnungen, Lieferanten-E-Mails und ERP-Bildschirme.
Hier sind die Daten, die jeder Dokumenttyp für den Abgleich bereitstellt:
| Dokument | Quelle | Wichtige Felder für den Abgleich |
|---|---|---|
| Bestellung (발주서) | Ihr ERP | Bestellmenge, vereinbarter Stückpreis, gewünschtes Lieferdatum |
| Transaktionsaufstellung (거래명세서) | Lieferant (Papier/PDF mit Lieferung) | Gelieferte Menge, Artikelbezeichnung, Stückpreis auf der Aufstellung |
| Steuerrechnung (세금계산서) | Lieferant (über NTS e-Tax) | Berechnete Menge, berechneter Stückpreis, Nettowarenwert, Steuerbetrag, NTS-Zulassungsnummer |
Der Engpass ist die mittlere Spalte: Die Daten der Transaktionsaufstellung sind fast nie digital. Sie kommen auf Papier, an einer Box befestigt, oder als PDF-Anhang, vergraben in einer Lieferbenachrichtigungs-E-Mail. Bis diese Daten in Tabellenform vorliegen – im gleichen Format wie Ihre PO-Daten aus dem ERP und Ihre Steuerrechnungsdaten aus dem NTS-System – kann der 3-Wege-Abgleich nicht automatisiert werden.
Sobald die Daten der Transaktionsaufstellung in Excel extrahiert sind, können Sie berechnete Spalten verwenden, um den Abgleich direkt in der Ausgabe durchzuführen. Definieren Sie eine Spalte wie Diff: Bestellte Menge vs. Gelieferte Menge (PO-Menge - Menge) und die KI berechnet die Differenz für jede Position während der Extraktion. Jede Zeile mit einer Differenz ungleich Null wird markiert, bevor die Tabelle überhaupt geöffnet wird. Wenn Sie Bestellungen über dieselbe Extraktionspipeline verarbeiten, können Sie auch PO-Daten nach Excel extrahieren – beide Dokumenttypen werden so in dasselbe strukturierte Format für den direkten Vergleich gebracht.
Für ein paralleles Szenario – die spezifische Extraktion von Steuerrechnungsdaten – finden Sie in unserem Leitfaden zum Extrahieren koreanischer Steuerrechnungsdaten nach Excel Informationen zu den sieben Pflichtfeldern und dem vierteljährlichen Mehrwertsteuer-Meldeverfahren. Wenn Sie große Mengen an Rechnungen für die Mehrwertsteuermeldung verarbeiten, behandelt der Leitfaden zur Stapelverarbeitung von Steuerrechnungen den Durchsatzaspekt.
Stapelverarbeitung: Tägliche Transaktionsaufstellungen verarbeiten
Die Einzelextraktion löst das Problem pro Dokument. Die Stapelverarbeitung löst das Problem des täglichen Volumens – und das, ohne dass Sie einen Teil der Einrichtungsarbeit wiederholen müssen.
Die Spaltendefinition, die Sie in Schritt 2 oben erstellt haben, ist nicht dokumentspezifisch. Sie beschreibt die gewünschten Felder, nicht wo diese Felder erscheinen. Das bedeutet, Sie können 20 Transaktionsaufstellungen von 15 verschiedenen Lieferanten – alle mit unterschiedlichen Layouts – in einem einzigen Stapel hochladen. Dieselbe Spaltendefinition wird auf jedes Dokument angewendet. Die Ausgabe ist eine konsolidierte Tabelle, in der jede Position aus jeder Aufstellung eine Zeile belegt, wobei Lieferantenname und Datum über alle Zeilen desselben Dokuments ausgefüllt werden.
Ein Beschaffungsteam, das 30 Transaktionsaufstellungen pro Woche erhält, spart etwa 3–4 Stunden manuelle Dateneingabe. Bei geschätzten Stundenkosten von KRW 18.000–25.000 für einen Beschaffungssachbearbeiter entspricht dies monatlichen Einsparungen von KRW 220.000–400.000 durch eine einzige Workflow-Änderung. Diese Zahl umfasst nicht die eingesparte Zeit für Fehlerkorrekturen, die in der Praxis der Eingabezeit selbst entsprechen oder diese sogar übersteigen kann.
Für Lieferanten, die regelmäßig Papieraufstellungen mit Lieferungen senden, kann ein Sammellink (수집 링크) den Digitalisierungsschritt vorgelagert verlagern. Generieren Sie eine teilbare URL – ohne Anmeldung für den Lieferanten – und fügen Sie sie in Ihre Lieferanten-Onboarding-Anweisungen ein. Der Lieferant öffnet den Link auf seinem Telefon, gibt einen kurzen Verifizierungscode ein und lädt ein Foto oder PDF der Transaktionsaufstellung direkt in Ihre Verarbeitungswarteschlange hoch. Das Dokument kommt bereits digitalisiert an, und Ihr Team extrahiert die Daten, anstatt sie neu einzutippen. Dies ist derselbe Mechanismus, der in unserem Leitfaden zur koreanischen Belegextraktion beschrieben wird, angepasst an den B2B-Beschaffungskontext.
Bei der Stapelverarbeitung von Transaktionsaufstellungen zusammen mit anderen Lieferdokumenten ist der Extraktionsworkflow identisch – Spalten einmal definieren, alles hochladen, eine Tabelle herunterladen. Das Tool zur Extraktion von Lieferscheinen deckt dasselbe Muster für vom Spediteur ausgestellte Lieferscheine ab, die Transaktionsaufstellungen häufig bei derselben Sendung begleiten.
FAQ
Muss ich für jedes Lieferantenformat eine separate Einrichtung vornehmen?
Nein. Die spaltennamenbasierte Extraktion findet Felder anhand ihrer Bedeutung, nicht ihrer Position. Dieselbe Spaltendefinition – Lieferantenname, Artikelbezeichnung, Menge, Stückpreis, Nettowarenwert – funktioniert bei jedem Layout, da die KI das Dokument visuell liest und versteht, was jedes Feld repräsentiert, unabhängig davon, wo der Lieferant es auf der Seite platziert hat.
Kann das System auch handschriftliche Transaktionsaufstellungen verarbeiten?
Ja, bei gedruckten Vorlagen mit handschriftlichen Einträgen – dem gängigsten Papierformat in der koreanischen Logistik, bei dem Lieferanten eine leere 거래명세서-Vorlage ausdrucken und Mengen und Daten von Hand eintragen. Vollständig handschriftliche Dokumente ohne gedruckte Struktur sind schwieriger und die Genauigkeit geringer. Das System behandelt Stempel (직인) und Unterschriften als visuelle Elemente – es erkennt deren Vorhandensein, extrahiert aber keinen Text daraus.
Wie unterscheidet das System zwischen Nettowarenwert (공급가액) und Steuerbetrag (세액)?
Die KI versteht die semantische Hierarchie des Dokuments. Der 공급가액 ist der Gesamtbetrag vor Mehrwertsteuer. Die 세액 beträgt in der Regel 10 % dieses Betrags (koreanischer Mehrwertsteuersatz). Wenn Sie beide Spalten definieren, nutzt die KI deren Beziehung zur Validierung der Extraktion – stimmt ein erkannter, als 공급가액 gekennzeichneter Wert nicht mit der erwarteten Beziehung zur 세액 überein, wird das System dies kennzeichnen. Sie können auch eine berechnete Spalte wie MwSt. prüfen (세액 / 공급가액) definieren, um das Verhältnis für jede Zeile auszugeben.
Kann ich Daten direkt in ECOUNT oder Douzone statt in Excel extrahieren?
Das direkte Ausgabeformat ist Excel (XLSX), CSV oder JSON. Sowohl ECOUNT als auch Douzone unterstützen den Excel-Import für Transaktionsdaten – exportieren Sie als XLSX und nutzen Sie die Importfunktion Ihres ERP-Systems, um die Daten zu laden. Die Spaltennamen in Ihrer Excel-Ausgabe können so konfiguriert werden, dass sie den Importfeldnamen Ihres ERP-Systems entsprechen, wodurch der Zuordnungsschritt entfällt.
Was ist mit Dokumenten, die gemischte koreanische und englische Felder enthalten?
Die KI liest beide Sprachen. Viele koreanische Transaktionsaufstellungen enthalten englische Artikelbezeichnungen neben koreanischen Beschreibungen, insbesondere bei importierten Waren oder multinationalen Lieferketten. Definieren Sie Ihre Spalten in der Sprache, die Sie für die Ausgabe benötigen – die KI findet die entsprechenden Werte unabhängig von der Sprache des Quelldokuments.
Nächste Schritte
Die Lücke in der koreanischen B2B-Dokumentinfrastruktur liegt nicht auf der Ausstellungsseite — ECOUNT, Douzone und das NTS-e-Tax-System haben Steuerrechnungen bereits durchgängig digitalisiert. Die Lücke liegt auf der Empfangsseite: den Dokumenten, die Ihre Lieferanten Ihnen senden und die nie dafür konzipiert wurden, maschinenlesbar zu sein. Transaktionsaufstellungen stehen im Zentrum dieser Lücke, da sie die Beschaffungsabstimmung, den Wareneingang und die Zahlungsfreigabe betreffen — drei Arbeitsabläufe, auf die nachgelagerte Finanzteams angewiesen sind.
Diese Lücke zu schließen erfordert nicht, dass Ihre Lieferanten ihre Dokumentenausstellung ändern. Es erfordert, dass Ihr Team ändert, wie es eingehende Dokumente verarbeitet. Dieselbe Transaktionsaufstellung, für deren Abtippen in Ihr Wareneingangsprotokoll 8 Minuten benötigt wurden, kann in Sekunden extrahiert werden — mit derselben Spaltendefinition, die auch auf die morgige Aufstellung eines anderen Lieferanten in einem anderen Format funktioniert.