300 koreanische Belege, eine Tabelle:
Steuererklärung im Batch ohne den Mai-Stress
Bei drei Minuten pro Beleg – die Zeit, um das Datum auf einem verblassten Kassenbon zu finden, den Händlernamen auf Koreanisch einzutippen, den Betrag zu übertragen und zu entscheiden, ob es sich um Verpflegung (식대), Transport (교통비) oder Büromaterial (사무용품비) handelt – kosten 300 Belege 15 Stunden Dateneingabe. Bei 500, einer realistischen Jahresmenge für einen Freiberufler mit regelmäßigen Kundenessen, Fahrten und Gerätekäufen, sind es 25 Stunden. Aber die wahren Kosten sind nicht die drei Minuten. Es ist die Entscheidungsmüdigkeit, 500 Mal dasselbe zu tun, jedes Mal mit einem anderen Format: ein sauber gedruckter Kartenbeleg einer Restaurantkette, ein Thermopapierbeleg, der nach sechs Monaten im Schuhkarton bereits verblasst, ein handschriftlicher Beleg (간이영수증) vom Baumarkt um die Ecke, der keine Bargeldbelege (현금영수증) ausstellt.
Wichtige Erkenntnisse
- 300 Belege à 3 Minuten = 15 Stunden Tipparbeit – bevor Sie auch nur eine einzige Zeile für die umfassende Einkommensteuererklärung in 식대, 교통비 oder 사무용품비 kategorisieren.
- Das koreanische Steuerökosystem – HomeTax-Downloads, 삼쩜삼-Abzugsrechner, Banking-App-CSVs – hat die behördliche Buchführung digitalisiert, aber nie automatisiert, was ein Freiberufler mit 300 physischen Kartenbelegen und handschriftlichen 간이영수증 in einem 31-tägigen Meldefenster macht. Die Stunden sind keine Steuerberechnung. Sie sind Transkription.
- Definieren Sie Ihre Spalten einmal, legen Sie alle 300 Belege als einen Batch in ImageToTable.ai ab und lassen Sie die KI jedes Dokument semantisch lesen – nach der Bedeutung eines Feldes, nicht nach der Position auf einem Kartenbeleg, einem HomeTax-Ausdruck oder einem handschriftlichen Formular. Ihr Mai verwandelt sich vom Erstellen von Daten zum Validieren.
Wenn Sie mit koreanischen Belegarten noch nicht vertraut sind – der Unterschied zwischen Kassenbons (현금영수증), Kartenbelegen (카드영수증) und vereinfachten Belegen (간이영수증) – beginnen Sie mit unserem Leitfaden zum Extrahieren koreanischer Belegdaten in Excel. Dieser behandelt den Einzelbeleg-Workflow, die drei Belegformate und den rechtlichen Rahmen nach dem Einkommensteuergesetz (소득세법). Dieser Artikel knüpft dort an: was sich ändert, wenn Sie von der Verarbeitung eines Belegs auf 300 Belege hochskalieren.
Das Belegvolumen, über das koreanische Freiberufler nicht sprechen
Koreas Freiberufler- und Einzelunternehmerschaft – von Entwicklern mit 3,3%-Quellensteuerverträgen über Designer mit Projektabrechnung, Berater mit mehreren Kunden bis hin zu kleinen Ladenbesitzern – erzeugt Belege in einer Geschwindigkeit, die jeden überrascht, der sie zum ersten Mal verfolgt. Ein Freiberufler, der fünfmal pro Woche mittags auswärts isst (250 Belege), täglich öffentliche Verkehrsmittel nutzt (weitere 250), Ausrüstung und Material kauft (20–30 mehr) und Software-Abos, Coworking-Spaces und Kaffees für Kundentreffen bezahlt (weitere 50–100), überschreitet die 500-Beleg-Marke, ohne es zu merken.
Das Steuersystem ist nicht dafür ausgelegt, dieses Volumen manuell zu verarbeiten – und doch ist das der Status quo. Nach Artikel 160 des Einkommensteuergesetzes (소득세법) müssen Geschäftstreibende Bücher und Belege für alle Transaktionen führen. Artikel 126-2 des Beschränkungen-Sondersteuergesetzes (조세특례제한법) sieht den Abzugsmechanismus für Kassenbons (현금영수증) vor – ein starker Compliance-Anreiz –, aber der Abzug existiert in der NTS-Datenbank, nicht in Ihrer Arbeits-Tabelle. Die Lücke zwischen „der Staat weiß von diesem Beleg" und „dieser Beleg ist in meiner kategorisierten Ausgabenliste" ist die Lücke, die jedes Jahr zwei Mai-Wochenenden verschlingt.
Die umfassende Einkommensteuererklärung (종합소득세) läuft vom 1. bis 31. Mai. Der Abzugsmechanismus für notwendige Ausgaben (필요경비) gibt Ihnen die Wahl: den vereinfachten Ausgabensatz (단순경비율) akzeptieren – ein Pauschalprozentsatz Ihres Umsatzes ohne Belegverfolgung – einfach, aber suboptimal für jeden mit echten Ausgaben – oder tatsächliche Ausgaben nach dem Standard-Ausgabensatz (기준경비율) geltend machen, was erfordert, dass jeder Beleg kategorisiert, summiert und dokumentiert wird. Der Unterschied zwischen beiden Methoden kann für einen Freiberufler mit 8 Millionen Won abzugsfähigen Ausgaben bei 40 Millionen Won Umsatz mehrere hunderttausend Won Steuern ausmachen. Dieser Unterschied wird Beleg für Beleg verdient. Und er wird schneller verdient, wenn Sie sie in Chargen verarbeiten, nicht einzeln.
Bei 300 Belegen mit einer durchschnittlichen manuellen Eingabezeit von 3 Minuten pro Beleg – inklusive Finden des Belegs in Ihrem Stapel, Öffnen Ihrer Tabelle, Eingabe von vier bis fünf Feldern und Zuweisen einer Kategorie – verbraucht die Dateneingabe 15 Stunden. Mit der Batch-Extraktion tauschen Sie diese 15 Stunden gegen etwa 5 Minuten Spalteneinrichtung, ein paar Minuten Verarbeitung und etwa 30 Minuten gezielter Validierung. Der Effizienzgewinn liegt nicht darin, jeden Beleg schneller zu machen. Es liegt darin, die Einzelbeleg-Schleife vollständig zu eliminieren.
Warum HomeTax, 3.3 (삼쩜삼) und SSEM die Lücke nicht schließen
Koreanische Freiberufler starten nicht bei null. Die digitale Infrastruktur für die Steuererklärung in Korea gehört zu den fortschrittlichsten weltweit – ihre Abdeckung ist jedoch über die drei tatsächlich existierenden Belegarten ungleichmäßig verteilt.
HomeTax (홈택스), das Online-Portal des Nationalen Steuerdienstes, führt eine vollständige digitale Aufzeichnung aller Bargeldbelege (현금영수증), die auf Ihre Einwohnermeldenummer oder Unternehmensregistrierungsnummer ausgestellt wurden. Sie können sich einloggen, zur 현금영수증-Abfrageseite navigieren und eine CSV-Datei aller Bargeldbelege für einen beliebigen Zeitraum herunterladen. Die Daten sind sauber: Transaktionsdatum, Betrag, Händler-Unternehmensnummer, Genehmigungscode. Es handelt sich jedoch um aggregierte Daten – eine Liste von Transaktionen, keinen kategorisierten Ausgabenbericht. Die HomeTax-CSV teilt Ihnen mit, dass Sie 850.000 Won für „Lebensmittel“ ausgegeben haben, ohne Ihnen zu sagen, welche Mahlzeiten Kundentreffen (als Geschäftsausgabe abzugsfähig) und welche Mittagessen allein (private Ausgabe, nicht abzugsfähig) waren. Und sie deckt nur Bargeldbelege ab – etwa ein Drittel bis die Hälfte des gesamten Belegvolumens eines Freiberuflers.
Bank- und Karten-Apps – KB Kookmin, Shinhan, Samsung Card, Hana – stellen jeweils ihren eigenen Transaktionsverlauf in ihrem eigenen Format bereit. Ein Freiberufler mit einem Girokonto bei einer Bank und Kreditkarten von zwei verschiedenen Anbietern steht vor dem gleichen Problem über drei Portale hinweg: CSV herunterladen, Formate abgleichen, in einem Blatt zusammenführen. Jedes Kartenunternehmen strukturiert seinen Export anders – eines verwendet JJJJ.MM.TT, ein anderes MM/TT/JJJJ, ein drittes bezeichnet die Händlerspalte als „가맹점명“, während ein anderes „사용처“ verwendet. Die Zusammenführung ist manuell und dort schleichen sich Fehler ein.
Steuererstellungs-Apps wie 삼쩜삼 (3.3), SSEM (쎔, von Viva Republica, dem Unternehmen hinter Toss) und 자비스 (JOBIS, das sich an Kleinunternehmer richtet) haben den Prozess der Steuererstellungsvorbereitung erheblich automatisiert. Sie rufen 현금영수증-Daten per Scraping oder API von HomeTax ab, aggregieren Kartentransaktionsdaten und berechnen geschätzte Erstattungsbeträge (예상환급세액). Insbesondere 삼쩜삼 ist zur bevorzugten App für Freiberufler geworden, die ihre Steuern selbst einreichen – es sammelt automatisch Bargeldbelegdaten und wendet die korrekten Abzugskategorien an. Aber keine dieser Apps extrahiert Daten aus physischen Belegen: einem fotografierten Kartenbeleg, einem gescannten 간이영수증, einer PDF-Rechnung eines Ausrüstungslieferanten. Die Automatisierung endet an der digitalen Grenze. Alles auf Papier bleibt auf Papier – oder gelangt über Ihre Tastatur in Ihre Tabellenkalkulation.
Das koreanische Steuerökosystem hat die Frontend-Seite digitalisiert – die Belegausstellung und die staatliche Buchführung. Es hat die Backend-Seite nicht digitalisiert – was ein Freiberufler mit 300 Belegen aus drei verschiedenen Quellen macht, wenn die Frist am 31. Mai näher rückt.
Was sich ändert, wenn Sie von 3 auf 300 Belege skalieren
Einen einzelnen Beleg zu verarbeiten ist einfach. 300 Belege zu verarbeiten ist ein grundlegend anderes Problem – eines, bei dem Herausforderungen, die bei geringer Stückzahl unsichtbar sind, zur Hauptreibungsquelle werden. Diese chargespezifischen Herausforderungen zu verstehen, ist der Unterschied zwischen einem Workflow, der eine saubere Tabelle liefert, und einem, der 300 Zeilen liefert, die Sie stundenlang nachbereiten müssen.
Gemischte Belegarten in einer Charge
Die drei koreanischen Belegarten – Kassenbelege (현금영수증), Kartenbelege (카드영수증) und vereinfachte Belege (간이영수증) – kommen in grundlegend unterschiedlichen Formaten. Ein Kassenbelegexport von HomeTax ist eine digitale CSV-Zeile. Ein Kartenbeleg ist ein Foto oder ein Screenshot aus einer Banking-App – sauberer Text, aber unterschiedliches Layout je nach Kartenaussteller. Ein 간이영수증 ist ein kleines Papierdokument, handschriftlich oder gestempelt, oft mit unregelmäßiger Positionierung von Datum, Betrag und Händlername, da es vom Ladenbesitzer an der Kasse ausgefüllt wird, nicht von einem Kassensystem generiert.
Bei der Einzelbelegverarbeitung sind die Formatunterschiede beherrschbar – Sie sehen sich jeden Beleg an und tippen ein, was Sie sehen. Bei der Chargenverarbeitung werden Formatunterschiede zu einem Test für das Design des Extraktionssystems. Die templatebasierte OCR, die Koordinaten auf einem bekannten Layout abgleicht, versagt sofort: Kein einzelnes Template deckt einen KB-Kookmin-Kartenbeleg, einen Baedal-Minjok (배달의민족)-Bestellbeleg und einen handschriftlichen 간이영수증 von einer lokalen Druckerei ab. Spaltennamensextraktion – bei der Sie die gewünschten Felder (Datum, Händler, Betrag, Kategorie) namentlich definieren und die KI sie auf jedem Dokument findet, indem sie deren Bedeutung versteht, nicht deren Position – behandelt Formatvielfalt als Standardbedingung. Dieselbe Spaltendefinition funktioniert über alle drei Belegarten hinweg, weil die KI das Dokument semantisch liest, nicht positionsbasiert.
Dateibenennung und Rückverfolgbarkeit
Bei 50 Belegen können Sie durch Ihre Handygalerie scrollen und den gesuchten finden. Bei 300 wird Scrollen zum Suchen – und Suchen erfordert Namen. Ein Chargen-Workflow erzeugt eine Ausgabetabelle, in der jede Zeile einem Beleg entspricht. Wenn eine Zeile den Händler "GS25 편의점" und den Betrag 4.500 Won angibt, müssen Sie diese Zeile zum ursprünglichen Belegbild zurückverfolgen können – für Ihre eigene Überprüfung und, falls nötig, auf Anfrage eines Steuerprüfers.
Eine konsistente Dateibenennungskonvention – JJJJ-MM-TT_Händler_Betrag, z. B. 2025-07-14_GS25_4500.jpg – ermöglicht die Durchsuchbarkeit von 300 Dateien. Die extrahierte Tabelle behält auch den ursprünglichen Dateinamen als Spalte bei und schafft so eine bidirektionale Verknüpfung: von der Tabellenzeile zur Datei und vom Dateinamen zu den Daten. Diese Rückverfolgbarkeit ist keine regulatorische Anforderung (der Nationale Steuerdienst schreibt kein bestimmtes Benennungsschema vor), aber sie ist der praktische Unterschied zwischen der Übergabe eines organisierten Pakets an Ihren Steuerberater (세무사) und der Übergabe eines Stapels.
Kategorisierung im großen Maßstab
Die Ausgabenkategorisierung ist der Schritt, den Freiberufler am meisten unterschätzen. Eine Quittung über 8.000 Won im Supermarkt könnte je nach gekauftem Artikel Verpflegung (식대), Büromaterial (사무용품비) oder Kommunikationskosten (통신비) sein. 300 Belege manuell zu kategorisieren – selbst wenn die Extraktion bereits Datum, Händler und Betrag erfasst hat – kostet eine weitere Stunde oder mehr Tabellenarbeit. Und hier leidet die Konsistenz: Derselbe GS25-Beleg, den Sie in Zeile 47 als 식대 eingestuft haben, wird in Zeile 198 als 사무용품비 kategorisiert, weil Sie müde waren und ihn anders gelesen haben.
Eine abgeleitete Spalte löst dies, indem die KI die Kategorie während der Extraktion bestimmt. Sie definieren eine Spalte wie Ausgabenkategorie (Optionen: 식대/Verpflegung, 교통비/Transport, 사무용품비/Büromaterial, 통신비/Kommunikation, 임차료/Miete, 소모품비/Verbrauchsmaterial, 기타/Sonstiges) – und die KI liest den Inhalt jedes Belegs, um die passende Kategorie zu wählen. Ein Taxibeleg mit Ziel Myeongdong wird zu 교통비. Ein Beleg von Alpha (알파문구) Schreibwarenladen wird zu 사무용품비. Ein Beleg von einem Mittagslokal in der Nähe Ihres Coworking-Spaces wird zu 식대. Extraktion und Klassifizierung erfolgen in einem Durchgang – kein separater Kategorisierungsschritt, kein zweiter Durchlauf durch 300 Zeilen, um jede zu beschriften.
Anomalieerkennung: Wenn die Extraktion falsch liegt
Kein Extraktionssystem erreicht 100% Genauigkeit bei jedem Beleg. Der Unterschied zwischen Stapelverarbeitung und Einzelverarbeitung liegt darin, wo der menschliche Aufwand anfällt: In einem Stapelworkflow erstellen Sie keine Daten von Grund auf – Sie validieren Daten, die für Sie generiert wurden. Der Prüfaufwand verschiebt sich von „4 Felder pro Beleg eingeben" zu „die Zeilen mit dem höchsten Fehlerrisiko stichprobenartig prüfen".
Die Belege mit dem höchsten Fehlerrisiko haben gemeinsame Merkmale: handschriftliche 간이영수증 mit unklarer Schrift, Thermoquittungen, die seit über sechs Monaten verblasst sind, schräg fotografierte Belege mit teilweiser Schattenabdeckung und Belege, bei denen der Gesamtbetrag auf mehrere Positionen aufgeteilt ist, ohne klare Zwischensumme. Statt alle 300 Zeilen gleichmäßig zu prüfen, konzentrieren Sie die Validierung auf diese Kategorien: handschriftliche Belege (alle prüfen), Belege über 100.000 Won (höchstes Prüfrisiko) und jede Zeile, deren Kategorie als „Sonstiges (기타)" zugewiesen wurde – der Sammelbegriff, den die KI verwendet, wenn sie die korrekte Klassifizierung nicht sicher bestimmen kann.
Der Batch-Workflow: Aus 300 Belegen eine steuerfertige Tabelle
Der Workflow spiegelt Ihre manuelle Vorgehensweise wider – Belege sammeln, Daten übertragen, kategorisieren – komprimiert die manuellen Schritte jedoch in einen einzigen automatisierten Durchlauf. So funktioniert es für ein ganzes Jahr koreanischer Belege.
Schritt 1: Sammeln und digitalisieren Sie Ihren gesamten Stapel
Zuerst digitale Quellen zusammenführen.
Laden Sie Ihre Barbeleg-CSV (현금영수증) von HomeTax herunter. Exportieren Sie Kartenumsätze aus jeder Banking-App – KB Kookmin, Shinhan, Samsung Card, je nachdem, was Sie nutzen. Speichern Sie E-Mail-Belege (Gerätekäufe, Software-Abos, Coworking-Rechnungen) als PDFs in einem Ordner. Diese digitalen Quellen decken etwa 60-70 % Ihres Belegvolumens ab und erfordern kein Fotografieren.
Papierbelege fotografieren.
Für Papier-Kartenbelege (카드영수증) und handschriftliche 간이영수증 nutzen Sie Ihre Handykamera. Legen Sie jeden Beleg flach auf eine dunkle Unterlage bei gleichmäßigem Licht – das vermeidet Schatten, die die KI verwirren. Erfassen Sie den gesamten Beleg von Rand zu Rand. Fotografieren Sie Thermo-Belege so bald wie möglich nach Erhalt – koreanische Belege aus Convenience-Stores und Restaurants verblassen innerhalb von 6-12 Monaten merklich. Ein Beleg vom Juli sollte nicht bis zum nächsten April warten.
Einheitliche Namenskonvention anwenden.
Benennen Sie jede Datei mit Datum, Händler und Betrag: YYYY-MM-DD_Händler_Betrag.ext. Selbst eine teilweise Benennung – 2025-08-15_Kyochon_12000.jpg – macht ein Verzeichnis mit 300 Dateien durchsuchbar. Falls das manuelle Umbenennen von 300 Dateien wie ein eigener Zeitfresser klingt: Die Batch-Extraktion behält den ursprünglichen Dateinamen in der Ausgabetabelle, sodass die Rückverfolgbarkeit auch ohne Umbenennung erhalten bleibt.
Schritt 2: Spalten definieren & alle Belege auf einmal hochladen
Definieren Sie die zu extrahierenden Spalten – einmalig für alle 300 Belege. Ein Mindestsatz für die koreanische Steuererklärung umfasst:
| Spalte | Zweck | Quellbelegart |
|---|---|---|
| Datum (거래일자) | Chronologische Sortierung, Prüfung auf Steuerjahreszugehörigkeit | Alle Arten |
| Händler (상호명) | Prüfbarkeit, Erkennung von Dubletten | Alle Arten |
| Betrag (금액) | Ausgabensumme, Kategorie-Zwischensummen | Alle Arten |
| Belegart (영수증 유형) | 현금영수증 / 카드영수증 / 간이영수증 – unterschiedliche Abzugsregeln | Alle Arten |
| Ausgabenkategorie (비용 항목) | Abgeleitet: 식대 / 교통비 / 사무용품비 / 통신비 / 임차료 / 소모품비 / 기타 | Alle Arten |
| Zahlungsmethode (결제수단) | Bar / Karte / Überweisung – Referenz für Abstimmung | Optional |
| Originaldateiname | Rückverfolgbarkeit: Verknüpfung jeder Zeile mit dem Quellbild | Automatisch |
Nach der Definition laden Sie alle 300 Belege – PDFs, JPGs, PNGs – als einen Batch hoch. Das Tool verarbeitet sie parallel und füllt eine Tabelle, in der jede Zeile einem Beleg und jede Spalte einem von Ihnen definierten Feld entspricht. Dieselben Spaltennamen funktionieren bei einem HomeTax-PDF-Ausdruck, einem KB-Kookmin-Kartenbeleg-Screenshot und einem handschriftlichen 간이영수증, weil die KI nach Bedeutung liest, nicht nach Koordinaten. Das ist der Kernunterschied zur vorlagenbasierten OCR – keine händlerspezifischen Vorlagen, keine formatabhängige Konfiguration, kein „diese Spalte funktioniert nur für diese Belegart".
Dateien werden sicher verarbeitet und nicht gespeichert.
Schritt 3: Exportieren und in Ihren Steuer-Workflow einbinden
Das Ergebnis ist eine einzige Excel-Datei – oder CSV, falls Ihre Steuersoftware ein bestimmtes Importformat erfordert. Jede Zeile steht für einen Beleg. Jede Spalte ist ausgefüllt. Die Spalte für die Ausgabenkategorie ist befüllt. Das ist die Tabelle, die Ihr Steuerberater (세무사) erwartet – und sie hat die Zeit eines einzigen Batch-Uploads gedauert, nicht 300 einzelne Einträge.
Wenn Sie 삼쩜삼 oder SSEM für Ihre Steuererklärung nutzen, kann die Tabellenausgabe als Ihr zentrales Ausgabenbuch dienen. Diese Apps kümmern sich um die Steuerberechnung, Optimierung der Abzüge und die elektronische Einreichung (전자신고) bei HomeTax – benötigen aber die zugrunde liegenden Ausgabendaten, und der Batch-Workflow liefert sie in einem konsumierbaren Format. Gleiches gilt, wenn Sie Ihre Unterlagen einem 세무사 übergeben: Eine kategorisierte Tabelle mit 300 Zeilen und Quellverweisen ist ein völlig anderer Übergabeprozess als ein Schuhkarton voller Belege und ein Kontoauszug. Die Kosten für die Zeit eines Steuerberaters – typischerweise 100.000–300.000 Won für die jährliche Erklärung eines Freiberuflers – beinhalten die Datenorganisation. Je weniger Zeit er mit Organisieren verbringt, desto mehr Zeit hat er für die Optimierung Ihrer Abzüge.
Für einen tieferen Einblick in die Mechanik eines einzelnen Belegs – einschließlich der Konfiguration von Spaltennamen für jeden Belegtyp und wie die Extraktion Felder wie die Unternehmensregistrierungsnummer verarbeitet – lesen Sie unsere Schritt-für-Schritt-Anleitung zur koreanischen Belegextraktion. Für die Batch-Verarbeitung eines anderen Dokumenttyps im selben koreanischen Markt behandelt unser Batch-Workflow für Steuerrechnungen/Umsatzsteuer das Äquivalent zu 세금계산서. Und wenn Ihre Arbeit mehrere Dokumenttypen umfasst – Belege, Rechnungen und Gehaltsabrechnungen – quantifiziert das Kostenframework für die koreanische Dokumentenverarbeitung, was die manuelle Eingabe für jeden einzelnen kostet.
300 Zeilen validieren, ohne sie neu einzutippen
Bei der Batch-Extraktion verlagert sich die menschliche Rolle von der Datenerstellung zur Datenvalidierung. Das ist eine bessere Nutzung Ihrer Zeit – aber nur, wenn die Validierung strukturiert ist. 300 Zeilen von oben nach unten zu scannen ist nur geringfügig schneller, als sie einzutippen. Eine gezielte Validierungsroutine für einen Batch mit 300 Belegen dauert etwa 30 Minuten und fängt die Fehler, die wirklich zählen:
- Nach Betrag absteigend sortieren und die obersten 20 Zeilen prüfen. Ihre größten Ausgaben – Gerätekäufe, jährliche Softwareabonnements, Büromiete – haben die höchsten steuerlichen Auswirkungen und das höchste Prüfungsrisiko. Überprüfen Sie jede einzelne mit dem Originalbeleg. Eine Ausgabe von 500.000 Won, die als Büromaterial (사무용품비) klassifiziert wird, obwohl es sich um ein Gerät (ein abschreibungsfähiges Wirtschaftsgut nach den Regeln des 소득세법) handelt, ändert deren Behandlung in Ihrer Steuererklärung.
- Die Spalte „Ausgabenkategorie" auf „Sonstiges (기타)"-Einträge durchsuchen. Dies sind Belege, bei denen die KI keine sichere Kategorie zuordnen konnte. In den meisten Batches erscheint „Sonstiges" bei 5-15 % der Zeilen – typischerweise handschriftliche Belege mit minimalem beschreibendem Text oder Belege von ungewöhnlichen Händlern. Ordnen Sie diese manuell der richtigen Kategorie zu.
- Konsistenz des Datumsbereichs prüfen. Sortieren Sie nach Datum und vergewissern Sie sich, dass kein Eintrag außerhalb des relevanten Steuerjahres (1. Januar bis 31. Dezember) liegt. Ein Beleg vom 3. Januar aus den Weihnachtsausgaben des Vorjahres, der sich in den diesjährigen Batch einschleicht, ist eine Korrektur, die nur darauf wartet, zu passieren.
- Stichprobenartig alle handschriftlichen 간이영수증-Zeilen prüfen. Handschriftliche Belege haben die größte Genauigkeitsspanne – von nahezu perfekt bei klar gedruckter Blockschrift bis unzuverlässig bei kursiver oder stark stilisierter Schrift. Wenn 간이영수증 mehr als 15-20 % Ihres gesamten Belegvolumens ausmachen, planen Sie zusätzliche Validierungszeit speziell für diese Zeilen ein. Wenn Sie weniger als 30 handschriftliche Belege in einem Batch haben, überprüfen Sie alle einzeln.
- Klassifizierung des Belegtyps überprüfen. Ein 간이영수증, der versehentlich als 현금영수증 klassifiziert wurde, ändert möglicherweise nicht den Betrag oder Händler, aber die steuerliche Behandlung unterscheidet sich – 간이영수증 hat eine Obergrenze von 30.000 Won pro Beleg nach koreanischen Steuerregeln, und die Vermischung in der falschen Spalte verschleiert diese Grenze.
Die ausgegebene Tabelle enthält für jede Zeile einen Verweis auf die Quelldatei. Klicken Sie zurück zum ursprünglichen Belegbild, um etwaige Fragen zu klären – kein Suchen in Ordnern, kein Abgleichen von Beträgen mit Belegen aus dem Gedächtnis. Die Rückverfolgbarkeit, die in der Vorbereitungsphase eine batch-spezifische Herausforderung war, wird in der Überprüfungsphase zum Validierungswerkzeug.
Das Thermopapier-Problem: Warum Februar zu spät ist
Koreanische Restaurants, Convenience Stores und kleine Einzelhändler verwenden überwiegend Thermopapier für Quittungen – das glänzende, chemisch beschichtete Papier, das Text durch Hitze statt Tinte erzeugt. Es ist billig, schnell und allgegenwärtig. Und es ist garantiert vergänglich. Nach 6–12 Monaten in einer typischen Wohnung oder einem Büro (nicht klimatisiert, Raumfeuchtigkeit und Licht ausgesetzt) ist eine Juli-Quittung deutlich blasser als eine vom November. Nach 18 Monaten wird der Text mancher Quittungen für das menschliche Auge unleserlich – und für KI.
Dies ist ein chargenspezifisches Zeitproblem, das sich als Formatproblem tarnt. Wer Quittungen monatlich verarbeitet – jede Quittung beim Eintreffen scannt – hat kein Problem mit Thermopapier, da das Bild erfasst wird, solange die Quittung noch frisch ist. Aber der Freiberufler, der Quittungen von Januar bis April in einer Schublade sammelt und in der ersten Maiwoche verarbeitet, liest Quittungen, die im Schnitt 6–8 Monate alt sind. Die Januar-Quittungen sind bereits 15 Monate alt und der Text verblasst sichtbar.
Die Faustregel: Digitalisieren Sie Thermopapier-Quittungen innerhalb von drei Monaten nach Erhalt. Wenn Sie dies im April lesen und einen Schuhkarton voller Quittungen vom letzten Sommer haben, digitalisieren Sie den Stapel sofort – das Verblassen hat bereits begonnen. Sobald eine Quittung unter die Lesbarkeitsschwelle für Menschen verblasst ist, kann auch kein KI-Tool die Informationen wiederherstellen. Das Extraktionssystem kann nur lesen, was sichtbar ist.
Häufig gestellte Fragen
Wie viele Quittungen kann ich auf einmal hochladen?
Es gibt kein festes Limit pro Batch. Ein für diesen Workflow entwickeltes Batch-Extraktionstool akzeptiert alle Ihre Quittungsbilder – JPG, PNG oder PDF – in einem einzigen Upload und verarbeitet sie zu einer Ausgabetabelle. Die Verarbeitungszeit skaliert mit der Menge: Ein Batch mit 300 Quittungen ist in Minuten erledigt.
Kann ich Bargeldbelege (현금영수증), Kartenbelege (카드영수증) und handschriftliche vereinfachte Belege (간이영수증) in einem Batch mischen?
Ja. Da die Extraktion spaltennamenbasiert ist – die KI liest jedes Dokument semantisch, um die Werte zu finden, die Ihren definierten Spaltennamen entsprechen – funktionieren dieselben Spaltendefinitionen für alle drei Belegformate in einem einzigen Batch. Ein HomeTax-PDF-Ausdruck, ein KB Kookmin-Screenshot und ein handschriftlicher 간이영수증-Foto erzeugen alle Zeilen in derselben Ausgabetabelle mit denselben befüllten Spalten.
Wie genau ist die automatische Ausgabenkategorisierung?
Bei Belegen mit klarem beschreibendem Text – einem Restaurantnamen mit „식당“ oder „반점“, einem Taxibeleg mit Abhol- und Zielort, einem Schreibwarenladenbeleg mit aufgelisteten Artikelnamen – ist die zugewiesene Kategorie zuverlässig. Bei Belegen mit minimalen Informationen – einem Kartenbeleg, der nur einen Händlernamen wie „주식회사 케이“ ohne Angabe des Gekauften zeigt – kann die KI ihn als „Sonstiges (기타)“ einstufen. Planen Sie Validierungszeit für diese „Sonstiges“-Einträge (typischerweise 5–15 % eines Batches) und für Belege von Händlern mit mehreren Kategorien wie Convenience-Stores oder großen Einzelhändlern ein, bei denen der Händlername allein keine Rückschlüsse auf die Art des Kaufs zulässt.
Funktioniert die Batch-Extraktion mit handschriftlichen vereinfachten Belegen (간이영수증)?
Teilweise. Klare, druckschriftartige Handschrift auf einem standardisierten 간이영수증-Formular (mit beschrifteten Feldern für Datum, Betrag und Händler) wird mit angemessener Genauigkeit extrahiert. Kursiv- oder verschnörkelte Handschrift, hastig an der Kasse ausgefüllte Belege sowie stark geknickte oder verschmutzte Belege weisen eine geringere Extraktionsgenauigkeit auf. Wenn handschriftliche Belege mehr als 15–20 % Ihrer jährlichen Gesamtmenge ausmachen, testen Sie zuerst einen Beispiel-Batch und planen Sie zusätzliche Validierungszeit für diese Zeilen ein. Der entscheidende Unterschied zur Einzelverarbeitung: In einem Batch-Workflow validieren Sie die handschriftlichen Zeilen – Sie tippen sie nicht von Grund auf neu. Selbst bei geringerer Genauigkeit in dieser Teilmenge ist die insgesamt eingesparte Zeit bei den restlichen 80–85 % der gedruckten und digitalen Belege erheblich.
Kann ich die Ausgabe in 3.3 (삼쩜삼) oder SSEM importieren?
삼쩜삼 und SSEM sind Plattformen zur Steuererklärungsvorbereitung – sie berechnen Ihre Steuerschuld und übermitteln die Daten elektronisch an HomeTax. Sie sind keine Ausgabendatenplattformen. Sie laden die kategorisierte Belegtabelle bei Ihrem Steuerberater (세무사) hoch oder nutzen sie als Ihr Hauptausgabenbuch für die manuelle Eingabe in die Steuerformulare. Die Tabellenausgabe dient als organisierte Quelle der Wahrheit – die Rohdaten, die in den von Ihnen gewählten Übermittlungsweg einfließen. Für Freiberufler, die selbstständig über HomeTax (홈택스 전자신고) einreichen, lässt sich die kategorisierte Tabelle direkt den Ausgabenabschnitten des Formulars zur umfassenden Einkommensteuererklärung zuordnen.
Was ist, wenn meine Belege bereits verblasst sind?
Wenn der Text auf einem Beleg für Ihr Auge unleserlich ist – die Zeichen so verblasst sind, dass Sie Datum, Händler oder Betrag nicht mehr lesen können – kann ein KI-Tool die Informationen nicht wiederherstellen. Das Extraktionssystem liest, was eine Kamera erfassen kann, und eine Kamera kann nicht erfassen, was nicht mehr sichtbar ist. Die Lösung ist vorbeugend: Digitalisieren Sie Thermo-papierbelege innerhalb von drei Monaten nach Erhalt. Für bereits verblasste Belege gleichen Sie diese mit Kontoauszügen oder Kartenumsatzhistorie ab, um die fehlenden Daten wiederzubeschaffen – diese digitalen Aufzeichnungen verblassen nicht.
Die Kosten des Wartens bis Mai
Der koreanische Steuererklärungskalender schafft einen vorhersehbaren Engpass: Freiberufler und Einzelunternehmer erhalten über 12 Monate hinweg 300–600 Belege, und das System verlangt, dass Sie alle in einem 31-Tage-Fenster organisieren. Der Engpass liegt nicht in der Steuerberechnung – 삼쩜삼 und HomeTax erledigen das. Der Engpass liegt in der Datenextraktion, der Kategorisierung, der Zusammenstellung der Tabelle. Und wenn man es Beleg für Beleg macht, verbraucht der Engpass Zeit, die linear mit der Menge skaliert – jeder zusätzliche Beleg fügt drei weitere Minuten hinzu, jedes Jahr des Wachstums fügt mehr Belege hinzu.
Die Batch-Extraktion macht die Notwendigkeit, Ihre Daten zu überprüfen, nicht überflüssig – die Überprüfung ist ein Schritt, den jeder verantwortungsbewusste Einreicher durchführt. Sie macht es überflüssig, die Daten von Grund auf neu zu erstellen: das Tippen, das Abschreiben, das Raten der Kategorie, das in Zeile eins neu beginnt und sich 299 weitere Male wiederholt. Bei 300 Belegen ist die Rechnung klar: fünf Minuten für die Spalteneinrichtung, ein paar Minuten für die Verarbeitung und etwa eine halbe Stunde für gezielte Validierung. Unter einer Stunde gegenüber dem Großteil von zwei Arbeitstagen. Die Effizienz liegt nicht darin, jeden Beleg schneller zu bearbeiten – sie liegt darin, die Beleg-für-Beleg-Schleife zu eliminieren, sodass Ihr Mai daraus besteht, Arbeit zu prüfen, nicht sie zu erstellen.
Probieren Sie es mit Ihrem eigenen Stapel aus. Sehen Sie, ob sich die Belege, die Sie seit Januar aufgeschoben haben, in eine Tabelle verwandeln, die Sie in einem Durchgang validieren können – und ob die Reaktion Ihres Steuerberaters auf den Erhalt einer organisierten, kategorisierten Datei anstelle von Umschlägen voller Papier die Bestätigung ist, dass der Workflow funktioniert.