Unternehmensregistrierungsnummern, Lieferwerte und Mehrwertsteuer aus koreanischen Steuer- und Geschäftsdokumenten extrahieren
HomeTax (홈택스) deckt elektronische Steuerrechnungen ab, aber Kassenbons, Lieferscheine und Papierrechnungen, die als PDFs, Scans und Fotos eingehen, werden weiterhin von Hand erfasst. Dieses Tool liest alle davon mit einem einzigen Spaltensatz.
5–10 Sek. pro Seite · Bis zu 99 % Genauigkeit bei gedrucktem koreanischem Text
Jeder koreanische Steuerdokumenttyp, ein Spaltensatz
Eine Steuerrechnung (세금계산서) und ein Kassenbon (현금영수증) haben keine gemeinsame visuelle Struktur – aber sie teilen dieselben Kernfelder. Mit der Benutzerdefinierten Spaltenextraktion benennen Sie die benötigten Felder; die KI findet sie anhand der Bedeutung, nicht der Position.
Dies sind die Spaltennamen, die Sie eingeben – die KI findet passende Werte unabhängig vom Format.
Koreanische Steuerdokumente sind eine Familie unterschiedlicher Formate
Eine gedruckte Steuerrechnung, ein Thermokassenbon und eine staatliche Gewerbeanmeldung sehen völlig unterschiedlich aus – doch alle drei enthalten dieselbe Unternehmensregistrierungsnummer (사업자등록번호). Semantische Extraktion findet diese Nummer anhand ihrer Bedeutung, sodass Formatunterschiede keine Rolle mehr spielen.
Warum koreanische Steuerdokumente herkömmliche Extraktion scheitern lassen
HomeTax (홈택스) deckt nur systemgenerierte E-Rechnungen ab. Das Portal des National Tax Service (국세청) verarbeitet elektronische Steuerrechnungen, die über das eigene System übermittelt werden – aber Papierrechnungen, PDFs, Fotos und Scans von Lieferanten außerhalb der E-Pflicht sowie Lieferscheine (거래명세서), die kein staatliches System erhält, bleiben weiterhin manuell.
Dasselbe Feld erscheint in unterschiedlichen Layouts. Die Unternehmensregistrierungsnummer (사업자등록번호) ist eine 10-stellige Kennung, die auf Steuerrechnungen, Kassenbons (현금영수증) und Gewerbeanmeldungen (사업자등록증) gedruckt wird – drei Dokumente ohne gemeinsame Struktur. Vorlagenbasierte Tools müssen für jedes einzelne neu konfiguriert werden; eine Formatänderung bricht den Abgleich.
Das Feld, das Sie tatsächlich benötigen, ist nirgends gedruckt. Bei der Jahresendabrechnung (연말정산) ist der Engpass nicht das Übertragen von Daten und Beträgen – sondern die Ausgabenkategorie, ein Feld, das kein System generiert. Die 80–200 jährlichen Kassenbons eines Mitarbeiters müssen vor der Februar-Frist jeweils kategorisiert werden, wie Kleinunternehmer beschreiben – als „einen Schuhkarton voller Belege“ jede Steuersaison.
So liest die semantische Extraktion jedes koreanische Dokument
Spalten benennen – die KI findet Werte nach Bedeutung, nicht nach Position. Geben Sie einmal „Unternehmensregistrierungsnummer (사업자등록번호), Lieferwert (공급가액), Mehrwertsteuer (부가세액)“ ein. Das Modell erkennt die Unternehmensregistrierungsnummer (사업자등록번호) anhand des 3-2-5-Ziffernmusters und der Bezeichnungsbeziehung – ob auf einer Gewerbeanmeldung (사업자등록증), einem ERP-Ausdruck oder einer gescannten Steuerrechnung (세금계산서) – ganz ohne vorlagenspezifische Vorlage.
Ein Batch für alle Dokumenttypen. Laden Sie Steuerrechnungen (세금계산서), Kassenbons (현금영수증), Lieferscheine (거래명세서) und Bestellungen in denselben Batch hoch. Definieren Sie Spalten wie „Unternehmensregistrierungsnummer (사업자등록번호), Lieferwert (공급가액), Mehrwertsteuer (부가세액), Artikel, Menge, Gesamt.“ Die KI füllt jedes Dokument unabhängig aus – nicht zugehörige Spalten bleiben leer. Der Export ist eine konsolidierte Tabelle.
Abgeleitete Spalten leiten ab, was kein Dokument ausweist. Definieren Sie „Ausgabenkategorie (Optionen: 식대/교통비/사무용품비/임차료/통신비/소모품비/기타)“ und die KI liest den Inhalt jedes Belegs, bestimmt die Kategorie und füllt sie aus – Extraktion und Kategorisierung in einem Durchgang, bereit für Ihren Steuerberater (세무사).
Von einem Monat gemischter koreanischer Dokumente zu einer einreichungsfertigen Tabelle
Den gesamten gemischten Stapel hochladen
Wenn Sie einen Monat koreanischer Lieferantendokumente abgleichen, halten Sie Steuerrechnungs-PDFs (세금계산서), Thermo-Kassenbons (현금영수증), einen Lieferschein (거래명세서) und vielleicht eine fotografierte Papierrechnung eines kleinen Anbieters in den Händen. Ziehen Sie alle in einen Stapel — PDF, JPG, PNG oder WebP, kein Sortieren nach Typ erforderlich.
Die benötigten Felder benennen — einmal
Geben Sie Unternehmensregistrierungsnummer, Datum, Lieferant, Lieferwert, Mehrwertsteuer, Gesamtbetrag, Ausgabenkategorie ein. Ein Satz Spalten deckt Steuerrechnungen, Kassenbons und Lieferscheine ab. Die KI liest Lieferwert (공급가액) und Mehrwertsteuer (부가세액) aus der Rechnung, Genehmigungsnr. und Betrag vom Thermo-Kassenbon und die Positionszeilen vom Lieferschein — jeweils in die benannte Spalte einsortiert.
Eine einreichungsfertige Tabelle herunterladen
Die Verarbeitung dauert 5–10 Sekunden pro Seite. Das Ergebnis ist eine XLSX- oder CSV-Datei: jede Zeile ist ein Dokument, jede Spalte ein von Ihnen benanntes Feld. Rechnungszeilen enthalten Lieferwert und Mehrwertsteuer, Kassenbonzeilen Betrag und Genehmigungsnr., Lieferscheinzeilen Position/Menge/Gesamtbetrag — und jede Zeile hat bereits ihre Ausgabenkategorie ausgefüllt (~18× schneller als jeden Wert von Hand einzutippen).
Wann es am besten funktioniert – und wo Sie die Ausgabe prüfen
Die Extraktion zieht Daten zuverlässig aus dem Dokument – aber die Richtigkeit der Einreichung liegt in Ihrer Verantwortung.
Wann es am besten funktioniert
Klare Scans, PDFs und Fotos von gedruckten koreanischen Dokumenten. Maschinell erstellte Steuerrechnungen (세금계산서) und Gewerbeanmeldungen (사업자등록증) erreichen bei Standardlayouts bis zu 99 % Genauigkeit.
Gemischte Dokumenttypen in einem Batch. Steuerrechnungen (세금계산서), Kassenbons (현금영수증), Lieferscheine (거래명세서) und Bestellungen werden mit einem einzigen Spaltensatz verarbeitet – keine typspezifische Konfiguration, eine konsolidierte Tabelle.
Standardisierte Felder mit konsistenten koreanischen Bezeichnungen. Unternehmensregistrierungsnummer (사업자등록번호), Lieferwert (공급가액) und Mehrwertsteuer (부가세액) verwenden über alle Dokumenttypen dieselbe Bezeichnung – ideal für semantisches Matching.
Wann Vorsicht geboten ist
Stark komprimierte oder weitergeleitete Dokumentfotos. Bilder, die über Messaging-Apps geteilt werden, verlieren an Auflösung, und verblasstes Thermopapier verringert die Genauigkeit bei Genehmigungsnr. und Kleingedrucktem.
Vollständig handschriftliche koreanische Dokumente. Ein handschriftlicher Betrag auf einem vorgedruckten Steuerrechnungsformular funktioniert; unregelmäßige, vollständig handschriftliche Dokumente erfordern eine manuelle Prüfung der extrahierten Werte.
Das ist Extraktion, keine Einreichung. HomeTax (홈택스) enthält bereits strukturierte Daten für E-Rechnungen – dort ist keine Extraktion nötig. Für alles andere stichprobenartig einige Zeilen prüfen, bevor Sie die Zahlen an Ihren Steuerberater (세무사) weitergeben.
Häufig gestellte Fragen
Kann ich Daten aus einer koreanischen Steuerrechnung (세금계산서) und einem Kassenbon (현금영수증) im selben Batch extrahieren?
Ja. Definieren Sie einen Satz von Spaltennamen — Unternehmensregistrierungsnummer, Lieferwert, Mehrwertsteuer, Gesamtbetrag, Datum — und die KI verarbeitet jedes Dokument im Batch mit denselben Definitionen. Eine Steuerrechnung füllt Lieferwert und Mehrwertsteuer aus; ein Kassenbon füllt Betrag und Genehmigungsnr. aus. Nicht zutreffende Spalten bleiben pro Zeile leer. Die Ausgabe ist eine einzige Tabelle aus beiden Dokumenttypen.
Erkennt es koreanischsprachige Felder wie Unternehmensregistrierungsnummer (사업자등록번호) und Lieferwert (공급가액)?
Ja. Die Unterstützung der koreanischen Sprache ist in das Training des Vision-Modells integriert und nicht einer rein englischen Engine nachgelagert. Die KI liest Unternehmensregistrierungsnummern, Lieferwerte, Mehrwertsteuerbeträge, Daten und Empfängerinformationen, wie sie auf Koreanisch erscheinen, und leitet dann jeden Wert an die von Ihnen benannte Spalte weiter. Gedruckte und maschinenschriftliche koreanische Dokumente erreichen eine Genauigkeit von bis zu 99 %.
Kann es eine fotografierte oder Papier-Steuerrechnung verarbeiten, nicht nur eine PDF?
Ja. Ein klares Foto einer gedruckten Steuerrechnung, eine gescannte Kopie oder eine PDF — all das funktioniert; die KI liest den sichtbaren Dokumentinhalt direkt aus dem Bild. Für beste Genauigkeit fotografieren Sie das Dokument flach und mit gleichmäßiger Beleuchtung und vermeiden Sie es, die Ränder abzuschneiden, wo sich normalerweise Unternehmensregistrierungsnummern und Gesamtbeträge befinden.
Extrahiert es die Ausgabenkategorie, auch wenn sie nicht auf dem Dokument gedruckt ist?
Ja — dies ist das eine Feld, das kein koreanisches Steuersystem generiert. Definieren Sie eine Spalte wie Ausgabenkategorie (Optionen: 식대/교통비/사무용품비/임차료/통신비/소모품비/기타) und die KI liest den Dokumentinhalt, bestimmt die richtige Kategorie und füllt sie aus. Die Kategorisierung erfolgt im selben Durchgang wie die Extraktion, sodass Dokumente für die Jahresendabrechnung klassifiziert ankommen, nicht nur transkribiert.
Gibt es Lieferwert (공급가액) und Mehrwertsteuer (부가세액) als separate Spalten aus?
Ja. Benennen Sie „Lieferwert“ und „Mehrwertsteuer“ als zwei separate Spalten und die KI teilt sie korrekt auf — die 10 %-Mehrwertsteuer-Beziehung zwischen Lieferwert, Steuer und Gesamtbetrag wird verstanden, nicht geraten. Dies ist wichtig für die vierteljährliche Mehrwertsteuermeldung, bei der Liefer- und Steuerbeträge getrennt gemeldet werden. Das gleiche semantische Verständnis gilt für alle zehn Dokumenttypen auf dieser Seite.
Deep dives into Korean document extraction workflows: the step-by-step Korean tax invoice extraction guide — the workflow this page is built around · the complete guide to Korean cash receipt extraction for tax deductions · the Korea VAT deadline checklist for tax invoice data prep · how Korean document extraction pricing compares — government, ERP, and AI tools
If your task is filing the VAT return itself — the entire form turned into a full table rather than specific fields pulled out — VAT return form to Excel handles that different workflow.