Namen, Titel & Kontaktdaten aus jedem Visitenkartenfoto extrahieren
Das manuelle Abtippen von Kontaktdaten aus einem fotografierten Visitenkartenfoto in eine Tabelle dauert 2–3 Minuten pro Karte – dieses Tool liest sie in 5 Sekunden.
5 s pro Karte · Bis zu 99 % Genauigkeit bei gedrucktem Text
Was Sie aus einem Visitenkartenfoto extrahieren können
Benutzerdefinierte Spaltenextraktion ermöglicht es Ihnen, die Felder zu benennen – die KI findet jedes einzelne anhand seiner Bedeutung, nicht seiner Position.
Größter Text auf der Karte, Position variiert je nach Design. Die KI findet ihn anhand der Bedeutung, nicht der Koordinate.
Name der Organisation in der Nähe des Logos. Die semantische Extraktion liest den Label-Kontext, um Unternehmen von Slogan oder Adresse zu unterscheiden.
Berufsbezeichnung unter dem Namen, oft in kleinerer Schrift. Die KI unterscheidet sie vom Unternehmen, indem sie sie als Rolle erkennt.
Karten können Mobil, Festnetz und Fax auflisten. Definieren Sie Telefon 1 und Telefon 2 – die KI ordnet jedes anhand des Labels („M“, „O“) oder der Position zu.
Manche Karten führen zwei Adressen auf. Die KI leitet jede an E-Mail 1 und E-Mail 2 weiter, indem sie das Format erkennt – keine Daten gehen in einem zusammengeführten Block verloren.
Keine zwei Visitenkarten haben dasselbe Layout – aber die Felder sind immer gleich
Eine Visitenkarte soll Eindruck machen, nicht einer festen Spaltenreihenfolge folgen. Herkömmliche OCR liest alles als Textblock. Semantische Extraktion liest jedes Feld als das, was es darstellt.
Warum herkömmliche Tools scheitern
Layoutfreies Design macht positionsbasierte Extraktion unmöglich. Zonale OCR benötigt ein Rechteck, das um den Namen gezogen wird. Auf der nächsten Karte steht der Name woanders. Jedes Design erfordert eine neue Konfiguration.
Mehrere Kontaktkanäle auf einer Karte. Mobil, Festnetz, Fax, zwei E-Mails, LinkedIn, WeChat – herkömmliche OCR wirft alles in einen Textblock. Das Sortieren erfordert bei jeder Karte manuelle Arbeit.
Glanzpapier und schräge Fotos beeinträchtigen die OCR. Karten sind darauf ausgelegt, gut auszusehen, nicht gescannt zu werden. Glanzoberflächen reflektieren. Fotos von Messen sind selten frontal aufgenommen. Herkömmliche OCR erwartet flachen, kontrastreichen Text – reale Bedingungen liefern verstümmelte Ergebnisse.
Wie semantische Extraktion jede Karte liest
Spalten benennen – KI findet Werte anhand der Bedeutung. Geben Sie „Name, Firma, Titel, Telefon, E-Mail“ ein. Das Modell erkennt, wie ein Name oder eine Telefonnummer aussieht, und lokalisiert jedes Feld – unabhängig von der Position.
Kontakte mit benannten Spalten eindeutig zuordnen. Definieren Sie „Telefon 1, Telefon 2, E-Mail 1, LinkedIn“. Die KI liest Label-Präfixe („M“ vs. „O“), Symbole oder URL-Domains, um jeden Wert der richtigen Spalte zuzuordnen.
Visueller Kontext meistert Spiegelungen und Winkel. Das Modell liest trotz Reflexionen und Verzerrungen, weil es das Konzept eines Namens oder einer Telefonnummer versteht – es braucht keine perfekt scharfen Zeichen. Wie ein Reddit-Nutzer es formulierte: „Das größte Problem war nicht das Scannen – sondern die saubere Übertragung in Excel.“ Semantische Extraktion schließt diese Lücke.
Von einem Stapel fotografierter Visitenkarten zu einer sauberen Tabelle in drei Schritten
Visitenkarten fotografieren
Sie kommen von einer Konferenz mit einem Stapel von 30–50 Visitenkarten zurück. Fotografieren Sie jede Karte mit Ihrem Smartphone – JPG oder PNG. Manche sind glänzend, manche haben winzige Schrift, einige wurden im schummrigen Licht des Veranstaltungsorts schräg aufgenommen. Laden Sie alle auf einmal in einem einzigen Batch hoch. Kein Sortieren nach Kartendesign, Lichtverhältnissen oder Sprache nötig.
Felder einmal benennen
Geben Sie die benötigten Spaltennamen ein: Name, Firma, Position, Telefon, E-Mail. Hat eine Karte zwei Nummern, fügen Sie Telefon 2 hinzu – die KI ordnet jede Nummer anhand ihres Beschriftungskontexts zu. Derselbe Spaltensatz gilt für alle Karten im Batch, unabhängig davon, wie unterschiedlich ihre Designs sind. Sie konfigurieren keine kartenbezogenen Vorlagen oder zeichnen Extraktionszonen.
Eine einzige Tabelle herunterladen
Die Verarbeitung dauert etwa 5 Sekunden pro Karte. Das Ergebnis ist eine XLSX-Datei: jede Zeile ist eine Visitenkarte, jede Spalte ist ein von Ihnen benanntes Feld. Karten von der Veranstaltung in den Zeilen 1–35, eine bei einem Meeting erhaltene Visitenkarte in Zeile 36, alle in derselben Tabelle. Etwa 18-mal schneller, als jedes Foto zu öffnen und die Details manuell einzutippen (~2–3 Min. manuell pro Karte vs. ~5 Sek. hier).
Wann es am besten funktioniert – und wann Vorsicht geboten ist
Wann es am besten funktioniert
Gerade Aufnahmen, gleichmäßiges Licht. Karte flach auf einem Tisch – bis zu 99 % Genauigkeit bei gedrucktem Text.
Standard-Schriftarten. Erfassung nach semantischer Rolle, nicht pixelgenauem OCR.
Gemischte Kartendesigns in einem Batch. Unterschiedliche Layouts, gleicher Spaltensatz.
Wann Vorsicht geboten ist
Extreme Winkel, Spiegelungen oder starke Schatten. Verringern die Genauigkeit. Fotografieren Sie Karten flach unter gleichmäßigem Licht.
Zierschriften, Folienprägung, winzige dekorative Texte. Standard-Kontaktfelder verwenden lesbare Schriftarten. Dekorative Texte werden möglicherweise nicht extrahiert.
Text über fotografischen Hintergründen. Randlose Bilder verringern den Kontrast. Die semantische Extraktion hilft, aber bei sehr geringem Kontrast werden einige Felder schwieriger.
Nur sichtbare Daten – keine externe Anreicherung. Das Tool extrahiert, was auf der Karte gedruckt ist. Es validiert keine E-Mail-Adressen und gleicht Firmennamen nicht mit Registern ab.
Häufig gestellte Fragen
Liest die KI Name und Telefon auch von einer glänzenden, schräg fotografierten Karte korrekt aus?
Ein gerade, gleichmäßig ausgeleuchtetes Foto erzielt eine Genauigkeit von bis zu 99 %. Schräge Aufnahmen und Spiegelungen verringern diese, aber das Modell übertrifft dennoch die herkömmliche OCR – die bei einer 15-Grad-Neigung bereits 30–40 % Genauigkeit einbüßen kann. Das Modell liest durch Spiegelungen hindurch, indem es versteht, wie ein Name als Konzept aussieht. Für wichtige Kontakte fotografieren Sie die Karte flach auf einem Tisch.
Kann ich auch nicht standardmäßige Felder wie ein LinkedIn-Profil oder eine WeChat-ID extrahieren?
Ja. Geben Sie die benötigten Spaltennamen ein – LinkedIn, WeChat, Abteilung, Website – und die KI liest jedes Feld anhand seines umgebenden Label-Kontexts aus. Die benutzerdefinierte Spaltenextraktion funktioniert durch semantisches Verständnis: Wenn Sie es auf der Karte sehen und benennen können, kann die KI es extrahieren.
Eine Karte hat zwei Telefonnummern und zwei E-Mail-Adressen – landen diese in separaten Spalten?
Definieren Sie Telefon 1, Telefon 2, E-Mail 1, E-Mail 2. Die KI liest die Label-Präfixe („M“ vs. „O“), um jeden Wert seiner Spalte zuzuordnen. Wie ein Reddit-Nutzer in r/ios anmerkte, produzieren viele Scanner-Apps „Kontaktname wird als Firmenname getaggt“ – genau solche Feld-Fehlklassifikationen vermeidet die semantische Extraktion.
Kann ich Fotos von Visitenkarten mit einer Quittung oder einem Versandetikett im selben Batch mischen?
Ja. Ein Spaltensatz, der alle Felder abdeckt (Name, Firma, Sendungsnummer, Betrag). Die KI liest jedes Foto unabhängig und füllt nur das aus, was auf diesem Dokumententyp erscheint. Karten liefern den Namen; das Etikett liefert die Sendungsnummer. Vorlagenbasierte Tools erfordern eine separate Konfiguration pro Dokumententyp.
Zwei Telefonnummern ohne Beschriftung – wie ordnet die KI sie zu?
Die KI nutzt Positionshinweise: Die Nummer näher am Namen ist typischerweise das Mobiltelefon, die in der Nähe des Firmenlogos meist das Bürotelefon. Für eine garantierte Zuordnung fügen Sie eine Regel in Ihre Spalte ein, z. B. „Telefon (Mobil)“ vs. „Telefon (Büro)“ – die KI liest den semantischen Kontext der Platzierung jeder Nummer. Die Überprüfung eines Datensatzes pro unbekanntem Kartendesign dauert Sekunden.
Tiefergehende Einblicke in die Extraktion von Visitenkartenfotos: Wie KI strukturierte Daten aus einem Dokumentenfoto extrahiert, einschließlich Visitenkarten mit nicht standardmäßigen Layouts und spiegelnden Oberflächen · Beste mobile OCR-Apps 2026 – wo Visitenkartenscannen neben Beleg- und Dokumentenerfassung für mobile Nutzer passt
Durchsuchen Sie alle Szenarien zur Dokumentenfotografie auf der Übersichtsseite für Fotodokumente – Parkscheine, Zählerstände, Versandetiketten und mehr.