Benutzerdefinierte Feldextraktion

Benutzerdefinierte Feldextraktion: Definieren Sie die benötigten Felder und extrahieren Sie sie aus jedem Dokument

Die meisten Extraktionstools zwingen Sie, für jedes Dokumentformat Vorlagen zu konfigurieren – das dauert 15–30 Minuten pro Stück. Dieses Tool extrahiert Ihre benutzerdefinierten Felder aus jedem Layout in 5–10 Sekunden pro Seite.

5–10 s pro Seite · 99 % Genauigkeit bei gedrucktem Text · Nach Namen definieren · Keine Zonenvorlagen

Spaltennamen eingeben
Jedes Dokumentformat
Nach Excel exportieren
Keine Vorlageneinrichtung

Welche Felder Sie extrahieren können

Geben Sie die gewünschten Spaltennamen ein – die KI findet passende Werte auf jeder Seite, indem sie deren Bedeutung versteht, nicht deren Position. Anders als vorlagenbasierte Tools, bei denen Sie Zonen um jedes Feld zeichnen müssen, ermöglicht Ihnen die Benutzerdefinierte Spaltenextraktion, die gewünschte Ausgabe zu definieren, während die KI die Daten überall im Dokument findet.

Dokumenttitel
Dokumentnummer
Datum
Lieferant / Absender
Gesamtbetrag
Positionen
Steuerbetrag
Zahlungsbedingungen
Status
Bestellreferenz
Währung
Kategorie (abgeleitet)

Die von Ihnen eingegebenen Spaltennamen werden zu Ihren Excel-Überschriften. Die KI füllt die Werte aus jedem Dokument, jedem Layout – ohne Zonen, ohne Vorlagen.

Definieren Sie, WAS Sie wollen, nicht WO es steht

Vorlagenbasierte Tools verlangen, dass Sie Zonen zeichnen, Koordinaten festlegen oder Labels erstellen – Sie teilen der Maschine mit, wo die Daten auf der Seite liegen. Ändert sich das Layout, verschieben sich alle Zonen. Die benutzerdefinierte Feldextraktion dreht die Frage um: Sie sagen der KI, was Sie brauchen, und sie findet den Wert anhand der Bedeutung – an jeder beliebigen Position.

Die Kosten der Positionsdefinition von Feldern

01

Layoutbezogene Zonenkonfiguration skaliert nicht. Rechtecke zu zeichnen oder Labels für jedes Feld zu setzen, funktioniert bei einem Dokumentformat. Kommt ein zweites Lieferantenformat oder ein drittes Layout hinzu, erfordert jedes eine komplett neue Vorlage. Nutzer auf r/smallbusiness beschreiben die Kernfrustration: „Gibt es eine Software, die Daten aus PDFs basierend auf von mir definierten Feldern extrahiert“ – und nicht basierend auf Zonen, die die Software zu zeichnen zwingt.

02

Layoutänderungen verursachen stille Extraktionsfehler. Ein Lieferant verschiebt „Gesamtsumme“ von unten rechts nach unten links. Die Zonenvorlage läuft weiter – liest aber den falschen Wert in das korrekt benannte Feld. Es wird kein Fehler ausgegeben; Sie finden es erst heraus, wenn jemand die Zahlen prüft. Jedes Lieferanten-Redesign löst einen Wartungszyklus aus.

03

Vorlagen können keine gemischten Dokumenttypen verarbeiten. Müssen Sie Rechnungen, Quittungen und Screenshots zusammen verarbeiten? Vorlagenbasierte Tools erfordern separate Konfigurationen pro Dokumenttyp – sortieren, trennen, konfigurieren, dann verarbeiten. Ein Batch mit gemischten Dateien wird zu drei Batches mit drei Setups.

Spaltennamensextraktion: Definition nach Bedeutung, nicht nach Position

01

Feldnamen einmal eingeben, aus jedem Layout extrahieren. Geben Sie „Rechnungsnummer“, „Datum“, „Gesamtbetrag“ als Spaltenüberschriften ein – diese sind gleichzeitig Ihre Extraktionsanweisungen. Die KI liest jedes Dokument, indem sie versteht, was jeder Feldname bedeutet, und nicht, indem sie sich merkt, welche Pixelkoordinaten zu prüfen sind. Eine einzige Spaltendefinition funktioniert mit fünfzig Lieferantenformaten.

02

Formatänderungen unterbrechen Ihre Extraktion nicht. Wenn ein Lieferant sein Layout überarbeitet, erkennt die KI „4.287,50 €“ neben dem Wort „Gesamt“ immer noch als Gesamtbetrag – weil sie nach semantischer Bedeutung und nicht nach Pixelkoordinaten liest. Keine Vorlage zum Wiederaufbauen, keine Konfiguration zum Aktualisieren, keine stillen Fehler.

03

Eine Spaltenliste für gemischte Dokumenttypen. Rechnungen, Quittungen, Screenshots, Bestellungen – alle werden mit denselben Felddefinitionen verarbeitet. Die KI findet den „Gesamtbetrag“ in jedem Dokumenttyp, indem sie versteht, was „Gesamtbetrag“ im Kontext bedeutet. Kein Sortieren, keine separaten Vorlagen, keine typabhängige Konfiguration.

Von 20 Dokumenttypen zu einer einheitlichen Tabelle

1

Hochladen ohne Sortierung

Legen Sie Lieferantenrechnungen von fünfzehn Anbietern, fünf fotografierte Handwerkerbelege und zwei PNG-Screenshots eines Zahlungsdashboards ab. Jede Datei hat ein anderes Format – aber alle landen im selben Batch, ohne sortiert, getaggt oder an separate Vorlagen weitergeleitet zu werden.

2

Felder einmal definieren

Geben Sie die benötigten Spalten ein: Dokumenttyp, Datum, Lieferant, Rechnungsnummer, Gesamtbetrag, Steuer, Status. Dies sind gleichzeitig Ihre Ausgabekopfzeilen und Ihre Extraktionsanweisungen. Die KI findet jeden Wert, indem sie die Bedeutung des Feldnamens versteht – eine Spaltenliste für PDFs, Fotos und Screenshots.

3

Eine einzige, zusammengeführte Tabelle erhalten

Die Verarbeitung dauert 5–10 Sekunden pro Seite. Die Ausgabe ist eine einzelne XLSX-Datei, in der jede Zeile einem Dokument entspricht und die Spalten genau dem von Ihnen eingegebenen Schema folgen. Zwanzig Dokumenttypen, zwanzig verschiedene Layouts – eine saubere Tabelle. Es wurde keine Vorlage erstellt, keine Zone gezeichnet und kein Format konfiguriert.

Wann die benutzerdefinierte Feldextraktion ideal ist – und wann Vorsicht geboten ist

Ideale Anwendungsfälle

Verarbeitung vieler Anbieter und Formate. Eine Spaltendefinition verarbeitet 50 oder 2.000 Quellen – der Einrichtungsaufwand wächst nicht mit der Formatvielfalt. Eine einzige Feldliste funktioniert mit Rechnungen, Quittungen, Formularen und Screenshots.

Ad-hoc- und Einzelextraktion. Ein noch nie gesehenes Format wird beim ersten Kontakt verarbeitet – einfach die benötigten Felder eingeben und hochladen. Kein Trainingszyklus, keine Vorlagenwarteschlange.

Gedruckter Text auf sauberen Dokumenten. Maschinell gedruckte Dokumente (PDFs, Scans, klare Fotos) erreichen bis zu 99 % Genauigkeit – ohne dokumentenspezifisches Training oder Feinabstimmung auf Feldebene.

Wann Vorsicht geboten ist

Bei hohem Volumen mit festem Layout sind Vorlagen oft besser. Sie verarbeiten 10.000 identische Formulare pro Monat? Eine einzelne Vorlage ist pro Seite schneller. Der Vorteil der benutzerdefinierten Feldextraktion liegt in der Formatvielfalt, nicht in der Geschwindigkeit bei identischen Layouts.

Extreme Schreibschrift verringert die Genauigkeit. Stark stilisierte Handschrift oder enge Notizen auf zerknitterten Dokumenten führen zu geringerer Erkennungssicherheit – insbesondere bei Zahlenfeldern wie Beträgen oder Daten.

Datenextraktion, keine Geschäftslogik. Es wandelt Dokumentinhalte in strukturierte Daten um – keine ERP-Buchungen, Compliance-Prüfungen oder Genehmigungsworkflows. Die Extraktion ersetzt das manuelle Abtippen, nicht Ihre Geschäftssysteme.

Häufig gestellte Fragen

Kann ich benutzerdefinierte Felder aus einem Dokumententyp extrahieren, den ich noch nie verarbeitet habe, oder muss das Tool zuerst trainiert werden?

Kein Training erforderlich. Sie geben die gewünschten Spaltennamen ein – Belegnummer, Datum, Lieferantenname, Gesamtbetrag – und die KI findet passende Werte, indem sie die semantische Bedeutung jedes Feldnamens versteht. Keine Musterdokumente zum Beschriften, kein Modell zum Trainieren, kein „Laden Sie 50 Beispiele hoch und kommen Sie morgen wieder.“ Die Extraktion funktioniert ab dem ersten Dokument, das Sie hochladen.

Was passiert, wenn ein Lieferant sein Dokumentenlayout ändert, nachdem ich meine benutzerdefinierten Felder definiert habe?

Nichts bricht – das ist der größte betriebliche Vorteil gegenüber vorlagenbasierten Tools. Da die Extraktion auf semantischem Verständnis basiert, erfordert eine Neugestaltung des Rechnungslayouts durch einen Lieferanten keinen Vorlagenneubau oder eine Neukonfiguration von Zonen. Die von Ihnen definierten Spalten Rechnungsnummer, Lieferant und Gesamtbetrag liefern weiterhin korrekte Daten, da die KI diese Werte im neuen Layout weiterhin anhand ihrer Bedeutung erkennt. Formatänderungen erzeugen kein Wartungsereignis.

Kann ich Werte extrahieren, die nicht buchstäblich auf dem Dokument gedruckt sind, wie eine berechnete Summe oder eine abgeleitete Kategorie?

Ja – die benutzerdefinierte Feldextraktion beschränkt sich nicht auf das Kopieren von Gedrucktem. Sie können Berechnete Spalten definieren, indem Sie eine Berechnung in den Spaltennamen schreiben (z. B. „Zeilensumme (Menge × Einzelpreis)“), und die KI führt die Mathematik während der Extraktion durch. Sie können auch Abgeleitete Spalten definieren – geben Sie „Kategorie (Optionen: Verpflegung/Transport/Büro/Sonstiges)“ ein, und die KI klassifiziert jedes Dokument anhand seines Inhalts, selbst wenn auf dem Original keine Kategoriebezeichnung vorhanden ist. Extraktion, Berechnung und Klassifizierung erfolgen in einem einzigen Durchlauf.

Wie unterscheidet sich die benutzerdefinierte Feldextraktion von der Verwendung einer vorgefertigten Rechnungs- oder Belegvorlage?

Vorgefertigte Vorlagen beschränken Sie auf die Felder, die der Softwareanbieter für wichtig hielt – typischerweise Rechnungsnummer, Datum, Gesamtbetrag. Wenn Sie Bestellnummer, Lieferbedingungen oder Abteilungscode benötigen, sind Sie aufgeschmissen. Die benutzerdefinierte Feldextraktion ermöglicht es Ihnen, jedes Feld zu definieren, das Sie benennen können. Sie entscheiden, was wichtig ist – die KI findet es. Und anders als bei Vorlagen funktioniert Ihre benutzerdefinierte Feldliste dokumentenübergreifend, nicht nur mit einem vorkonfigurierten Layout.

Kann ich einem bestehenden Batch bereits verarbeiteter Dokumente neue Felder hinzufügen, oder muss ich alles neu extrahieren?

Wenn Sie für zukünftige Dokumente ein neues Feld benötigen, fügen Sie es einfach Ihrer Spaltenliste hinzu – kein Vorlagen-Update oder eine Neukonfiguration erforderlich. Für Dokumente, die bereits in einem vorherigen Batch verarbeitet wurden, ist der schnellste Weg, einen neuen Batch mit der erweiterten Spaltenliste zu erstellen und die zu aktualisierenden Dateien erneut hochzuladen. Die KI verarbeitet alle Dokumente in einem Durchlauf gegen die neue Spaltendefinition, sodass das Hinzufügen von Feldern nicht bedeutet, dass Sie Ihr Setup von Grund auf neu aufbauen müssen.

Weiterlesen: So verwenden Sie die benutzerdefinierte Spaltenextraktion — Eine Schritt-für-Schritt-Anleitung zur Einrichtung Ihrer ersten Extraktion, von der Benennung der Spalten bis zur Überprüfung der Ergebnisse. · Benutzerdefinierte Spaltenextraktion vs. Image to Table — Wann Sie Ihre eigenen Felder definieren sollten und wann die KI-Automatik die bessere Wahl ist. · Daten aus gescannten Formularen mit benutzerdefinierten Feldern extrahieren — Umgang mit Kontrollkästchen, Handschrift und gemischten Formularfeldern bei der benutzerdefinierten Extraktion.

📮 contact email: [email protected]