Guide du CPA pour l'extraction des formulaires fiscauxW-2 et 1099

Dans un cabinet fiscal comptant six préparateurs, le mois de mars signifie une table de salle de conférence couverte de chemises en manille — chacune remplie de W-2, 1099‑MISC, 1099‑NEC, 1099‑R et 1099‑DIV de clients. Un préparateur traite 80 déclarations en six semaines. 80 déclarations représentent environ 200 formulaires d'information à transcrire. Vous ne pouvez pas passer à l'échelle en embauchant plus de préparateurs — les plus expérimentés facturent déjà 200 à 400 $ de l'heure, et le premier trimestre est la période où tous les cabinets se disputent les mêmes talents. L'extraction de formulaires fiscaux élimine le goulot d'étranglement de la transcription : un préparateur vérifie chaque valeur de case que l'IA lit, au lieu de plisser les yeux sur des tailles de police propres à chaque employeur et de saisir les chiffres à la main. Pour une introduction générale aux types de formulaires et à la façon dont l'IA lit les libellés de cases de l'IRS, consultez notre guide des fondamentaux de l'extraction W-2 et 1099 — ce guide part du contexte du cabinet CPA et va directement au flux de travail.

Arrêtez la saisie manuelle — laissez l'IA lire vos documents
Image ou PDF — données structurées en 10 secondes
Essayer maintenant →
Image éditoriale vectorielle plate pour un guide d'extraction de formulaires fiscaux destiné aux CPA. Un grand titre bleu foncé indique Guide du CPA pour l'extraction des formulaires fiscaux W-2 et 1099 au-dessus de trois icônes en gras avec contours et légendes : W-2 et 1099, Un seul lot ; Lit les libellés de cases, pas les pixels ; et CSV prêt pour le logiciel fiscal, la dernière avec un badge de vérification sarcelle. Fond dégradé bleu clair avec des blocs d'angle bleus abstraits.

Points clés à retenir

  1. 1 000 W-2 et 1099 coûtent à un cabinet fiscal 33 heures de pure transcription chaque premier trimestre — et les avis de non-concordance CP2000 reçus des mois plus tard consomment encore 5 à 10 heures de temps de résolution non facturable.
  2. Un taux d'erreur de 2 % sur 1 000 formulaires génère 20 avis de l'IRS, chacun coûtant 15 à 30 minutes que le cabinet absorbe — car vous ne pouvez pas facturer un client pour corriger votre propre erreur de saisie.
  3. Une définition de colonne pour les W-2 et une par variante de 1099 : l'IA lit les salaires de la Box 1 et les codes de la Box 12 par leurs libellés, et non par position de pixel, donc la même configuration fonctionne avec ADP, Paychex, Gusto et toutes les autres mises en page de paie sans modification.

Pourquoi l’extraction des W-2 et 1099 doit se faire dans un seul flux de travail

Carte d’information vectorielle intitulée Pourquoi les W-2 et 1099 appartiennent à un même lot, avec trois icônes en gras en dessous : un calendrier intitulé Même échéance du 31 janvier, une case numérotée intitulée Numéros de case standard IRS, et un tableau avec une flèche intitulé Les deux alimentent la même déclaration. Fond bleu clair en dégradé avec des blocs d’angle bleus abstraits.

Dans la plupart des cabinets, les W-2 et 1099 arrivent dans le même lot — un client apporte un dossier début février avec les deux types de formulaires mélangés. Pourtant, la plupart des outils d’extraction et des flux de travail les traitent comme des problèmes distincts.

Les W-2 et 1099 partagent trois similitudes structurelles qui en font des candidats naturels pour un pipeline d’extraction unifié :

  • Même échéance de dépôt. Les W-2 et 1099-NEC doivent être fournis aux bénéficiaires au plus tard le 31 janvier et déposés auprès de l’IRS à la même date. Les formulaires arrivent simultanément et la fenêtre de traitement est identique.
  • Numérotation des cases standardisée par l’IRS. Chaque W-2 utilise les mêmes numéros de case (Box 1 est toujours le salaire, Box 2 est toujours la retenue d’impôt fédéral). Chaque variante de 1099 a sa propre disposition prescrite, mais les numéros de case sont cohérents au sein de chaque variante.
  • Même destination en aval. Les données extraites alimentent la même déclaration de revenus — les données des W-2 remplissent les lignes de salaire, les données des 1099 remplissent les lignes de revenus. Il ne s’agit pas de flux séparés, mais d’entrées pour la même déclaration.

La différence réside dans l’ensemble des champs. Un W-2 déclare les données salariales et de retenue côté employeur sur plus de 20 cases. Un 1099-NEC déclare la rémunération des non-employés côté payeur dans quelques cases. Les deux types de formulaires ne partagent que les champs d’identification payeur/bénéficiaire — tout le reste utilise un schéma différent. Un flux de travail unifié doit gérer les deux schémas à partir du même lot de téléversement.

Extraction de documents par IA rend cela possible car elle ne repose pas sur des modèles fixes. Avec l’Extraction de colonnes personnalisées, vous définissez les colonnes souhaitées — « Box 1 Wages » pour les W-2, « Nonemployee Comp » pour les 1099-NEC — et l’IA localise chaque valeur selon son sens sémantique dans chaque formulaire du lot. Le même dossier de téléversement peut contenir des W-2 d’ADP et des 1099-NEC d’Upwork, et chaque formulaire est mappé au bon ensemble de champs.

Le principe d’extraction : Vous définissez le schéma de sortie. L’IA lit le document et remplit les colonnes. La même définition de colonne fonctionne avec la disposition des W-2 de chaque employeur — car l’IA lit les numéros de case, pas les positions de pixels.

Le coût réel de la saisie manuelle des formulaires fiscaux

Chaque cabinet comptable sait que la saisie manuelle des données coûte cher. Mais le coût réel comporte quatre niveaux qui se cumulent au premier trimestre.

Carte de données vectorielle carrée et plate avec un énorme chiffre bleu foncé indiquant 5 000 à 13 000 $, légendé comme revenu perdu de 33 heures de transcription de W-2 à 150 à 400 $ de l'heure facturable, plus un triangle d'avertissement ambre étiqueté taux d'erreur de 2 % = 20 avis CP2000 pour 1 000 formulaires. Fond dégradé bleu clair avec des blocs d'angle bleus abstraits.

Compression des volumes. Les employeurs doivent fournir les W-2 aux employés avant le 31 janvier, et les 1099-NEC aux entrepreneurs à la même date. Tous les formulaires arrivent donc dans une fenêtre de quatre à six semaines. Un cabinet traitant 1 000 déclarations de renseignements ne peut pas étaler ce travail — tout arrive entre le 1er février et le 15 mars. Le personnel nécessaire pour absorber ce pic coûte cher : saisonniers pour la saisie, heures supplémentaires, ou mobilisation de collaborateurs seniors au détriment du conseil pour taper des chiffres.

Coûts des erreurs de transcription. L'IRS recoupe chaque déclaration de renseignements avec les déclarations déposées par les contribuables. Une divergence — EIN inversé, code Box 12 mal lu, montant erroné — déclenche un avis CP2000. Chaque avis coûte au cabinet 15 à 30 minutes de temps de résolution non facturable : retrouver le document source, comparer les chiffres, préparer une réponse. Un taux d'erreur de 2 % sur 1 000 formulaires génère 20 avis et environ 5 à 10 heures de temps facturable perdu. Le cabinet absorbe ce coût car il ne peut pas facturer au client la correction de sa propre erreur de saisie.

Coût d'opportunité des heures du premier trimestre. Aux tarifs horaires typiques des CPA de 150 à 400 $, 33 heures de transcription de W-2 représentent 5 000 à 13 000 $ de revenus perdus en conseil, déclarations complexes ou planification fiscale que le cabinet pourrait autrement réaliser. La saison fiscale est la période où la capacité est la plus contrainte — chaque heure passée à taper est une heure non consacrée à un travail facturable à prix fort.

Traînée de rapprochement interannuel. Les clients apportent des W-2 pluriannuels pour des déclarations modifiées ou des dépôts d'années antérieures. Les formulaires des années antérieures peuvent utiliser des mises en page légèrement différentes — l'IRS a ajusté la déclaration Box 12 ces dernières années — mais les données doivent correspondre à ce que l'IRS a en dossier depuis la soumission originale de l'employeur. La ressaisie des données des années antérieures double le travail de transcription et le risque d'erreur.

Ces quatre coûts combinés font de la saisie des données W-2 et 1099 l'une des cibles d'automatisation au meilleur retour sur investissement dans un cabinet fiscal — non pas parce que le travail est intellectuellement exigeant (c'est tout le contraire), mais parce que le volume est prévisible, l'échéance est immuable et les conséquences d'erreur sont concrètes.

Pour une vue plus large sur la façon dont l'extraction par OCR et IA s'intègre aux flux de travail comptables, consultez notre guide sur l'extraction de données documentaires pour les équipes comptables.

Tous les champs W-2 à extraire

Le formulaire W-2 déclare les salaires et les retenues d'impôt pour chaque employé. L'IRS impose que chaque W-2 suive une numérotation fixe des cases. Voici tous les champs importants pour un traitement fiscal standard.

CaseChampCorrespondance 1040
bN° d'identification employeur (EIN)Vérification IRS ; doit comporter 9 chiffres exacts
cNom et adresse de l'employeurIdentification de la déclaration ; dépôt d'État
eNom de l'employéDoit correspondre au dossier SSN
fAdresse de l'employéPré-remplissage de la déclaration
1Salaires, pourboires, autres rémunérationsLigne 1 du formulaire 1040
2Impôt fédéral sur le revenu retenuLigne 25a du formulaire 1040
3Salaires soumis à la Sécurité socialeAnnexe 2, ligne 11
4Taxe de Sécurité sociale retenueAnnexe 2, ligne 11
5Salaires et pourboires soumis à MedicareSeuil de la taxe Medicare supplémentaire
6Taxe Medicare retenueAnnexe 2, ligne 12
7Pourboires soumis à la Sécurité socialeAffecte le plafond des salaires SS
8Pourboires répartisFormulaire 4137
10Prestations pour soins aux personnes à chargeFormulaire 2441
11Régimes non qualifiésPeut être un revenu imposable
12a–12dCodes et montants (D = 401k, E = 403b, G = 457b, C = assurance-vie collective, etc.)Chaque code a un traitement fiscal différent
13Employé statutaire / Régime de retraite / Indemnité maladie par un tiersStatut de case à cocher
14Autres (cotisations syndicales, aide à l'éducation, etc.)Spécifique à l'employeur
15N° d'identification de l'État employeurIdentification pour le dépôt d'État
16Salaires d'ÉtatRevenu de la déclaration d'État
17Impôt sur le revenu d'ÉtatRetenue de la déclaration d'État
18–20Salaires locaux, taxe locale, nom de la localitéDéclaration locale (le cas échéant)

Les champs indispensables pour la plupart des déclarations sont les cases 1, 2, 3, 4, 5, 6, 12 (codes et montants), 15, 16, 17, ainsi que les informations d'identification de l'employé et de l'employeur (b, c, e). Pour la préparation fiscale, l'extraction doit inclure l'année d'imposition comme colonne afin que les lots multi-années restent correctement identifiés.

Les codes de la case 12 nécessitent une attention particulière. Le code D (report 401k) et le code C (assurance-vie collective au-delà de 50 000 $) se ressemblent visuellement dans certaines mises en page d'impression de l'employeur, mais ont un traitement fiscal totalement différent. Le système d'extraction doit lire précisément le code alphabétique et l'associer au montant correct. Une erreur de lecture de code est le type d'erreur qui passe la vérification initiale mais déclenche un avis de l'IRS des mois plus tard.

Toutes les variantes du 1099 et leurs cases essentielles

La famille des 1099 comprend au moins six types de formulaires courants. Chacun utilise une numérotation de cases différente. Un processus d'extraction unifié doit classer chaque formulaire avant d'appliquer le bon mappage des champs.

FormulaireObjetChamps clés à extraire
1099-NECRémunération des non-salariésCase 1a (Rémunération non-salariés), Case 4 (Retenue d'impôt fédéral), Cases 5–7 (État/local). Changement 2026 : La case 1 est divisée en 1a (rémunération), 1b (pourboires en espèces), 1c (code TTOC), 1d (rémunération des heures sup.) selon l'OBBBA.
1099-MISCRevenus diversCase 1 (Loyers), Case 2 (Redevances), Case 3 (Autres revenus), Case 4 (Impôt fédéral), Case 6 (Médical), Case 8 (Paiements de substitution), Case 10 (Assurance-récolte)
1099-INTRevenus d'intérêtsCase 1 (Intérêts de 10 $ ou plus), Case 2 (Pénalité de retrait anticipé), Case 3 (Intérêts exonérés d'impôt)
1099-DIVDividendesCase 1a (Dividendes ordinaires), Case 1b (Dividendes admissibles), Case 2a (Distributions de gains en capital)
1099-BProduit des opérations de courtageCase 1a (Gains/pertes à court terme), Case 2a (Gains/pertes à long terme), Case 3 (Prix de base déclaré à l'IRS)
1099-KOpérations par carte de paiement / tiersCase 1a (Paiements bruts par carte), Case 1b (Paiements bruts TPN), Case 2 (Code de catégorie marchande)

Les changements OBBBA de 2026 pour le 1099-NEC méritent une attention particulière. Le One Big Beautiful Bill Act a introduit des cases dédiées pour les pourboires en espèces et la rémunération des heures supplémentaires. La case 1 du 1099-NEC a été élargie en case 1a (rémunération des non-salariés, montant principal), case 1b (pourboires en espèces distincts), case 1c (code TTOC du Trésor) et case 1d (rémunération des heures sup.). Tout processus d'extraction conçu avant 2026 doit être mis à jour — si votre outil mappe encore tout sur la « Case 1 », il manquera les nouvelles sous-cases et risque de déclarer des montants incorrects.

Les relevés de courtage consolidés de Fidelity, Schwab et Vanguard ajoutent à la complexité. Un seul document de plusieurs pages peut contenir des données 1099-INT, 1099-DIV, 1099-B et 1099-MISC combinées. Le système d'extraction doit identifier où chaque type de formulaire commence et segmenter les données en enregistrements distincts — sinon, l'ensemble du relevé consolidé sera traité comme un seul gros 1099 avec les mauvais mappages de cases pour la majeure partie de son contenu.

Le défi : des formulaires identiques, des exécutions différentes

Les formulaires IRS sont normalisés par la réglementation, mais l'exécution dans le monde réel introduit cinq problèmes qu'un flux de saisie manuelle absorbe silencieusement — et qu'un flux automatisé doit gérer explicitement.

Comparaison en deux colonnes à plat vectorielle intitulée Pourquoi les modèles de pixels échouent sur les vrais W-2. Colonne de gauche avec un badge X ambre intitulé Correspondance par coordonnées de pixels et trois courtes puces se terminant par Échoue sur la mise en page suivante ; colonne de droite avec un badge de vérification sarcelle intitulé Lecture sémantique des cases et trois puces se terminant par Fonctionne sur toutes. Fond bleu clair en dégradé avec des blocs d'angle bleus abstraits.

Variations d'impression des employeurs. Les grands employeurs utilisent ADP, Paychex, QuickBooks Payroll et Gusto — chacun imprime les W-2 dans la mise en page spécifiée par l'IRS mais avec des polices, des épaisseurs de bordures de cases et des alignements différents. La copie A (la copie IRS) utilise une encre rouge délébile qui rend certains champs invisibles sur les photocopies. La copie B (copie employé) peut être une feuille unique ou un formulaire combiné avec les données d'État au verso. Certains employeurs impriment sur du papier cartonné perforé ; d'autres utilisent du papier ordinaire. La présentation visuelle diffère d'un fournisseur de paie à l'autre, même si la numérotation des cases est identique. Un outil d'extraction qui repose sur les coordonnées de pixels échouera. Un système sémantique qui lit les libellés des cases fonctionne avec tous.

Auto-classification des 1099. Un lot de 50 formulaires 1099 peut contenir 35 NEC, 10 MISC, 3 INT et 2 DIV. Chacun doit être classifié par type de formulaire avant l'extraction — une case 3 de 1099-MISC (« Autres revenus ») signifie quelque chose de complètement différent d'une case 3 de 1099-INT (« Intérêts exonérés d'impôt »). Le système d'extraction doit lire le titre du formulaire dans le coin supérieur gauche pour déterminer quelle variante de 1099 il traite, puis appliquer la correspondance de cases correcte pour cette variante.

W-2 multi-États. Un employé qui a travaillé dans plusieurs États aura plusieurs lignes d'État — les cases 15 à 17 répétées pour chaque État. L'IA doit regrouper l'identifiant d'employeur, les salaires et l'impôt de chaque État comme un seul enregistrement et ne pas mélanger les salaires de l'État A avec la retenue d'impôt de l'État B. Pour les employés en Floride, au Texas, au Nevada, à Washington, dans le Dakota du Sud, au Wyoming, en Alaska, au New Hampshire et au Tennessee — les États sans impôt sur le revenu — les champs d'État doivent être vides, et le système ne doit pas les signaler comme données manquantes.

Corrections manuscrites. Les petits employeurs rayent parfois une valeur imprimée sur un W-2 et écrivent le chiffre corrigé à la main. C'est le plus courant sur la case 1 lorsque l'employeur a effectué un ajustement de paie de dernière minute. L'IA lit l'écriture manuscrite avec une précision inférieure à celle du texte imprimé — attendez-vous à une précision de 70 à 85 % sur les corrections numériques manuscrites. Ces formulaires nécessitent une vérification manuelle.

Mauvaise qualité de numérisation. Les formulaires numérisés à 150 DPI ou moins, ou photographiés en angle avec un appareil photo de téléphone, produisent des libellés de cases dégradés. La différence entre la case 1 et la case 2 devient plus difficile à distinguer pour tout système. Le seuil d'extraction fiable est de 200 DPI minimum pour les numérisations et de photos nettes et prises de face pour les captures par smartphone.

Comment traiter les W-2 et 1099 en un seul lot

Voici un processus en six étapes qu'un cabinet CPA ou un préparateur fiscal peut suivre pour traiter un lot mixte de W-2 et 1099 à l'aide d'une extraction basée sur l'IA. Le processus suppose l'utilisation d'un outil d'extraction sémantique comme notre outil d'extraction W-2, le convertisseur 1099 vers Excel, ou notre convertisseur OCR général de formulaires fiscaux — mais les étapes s'appliquent à toute plateforme d'extraction sémantique.

1
Trions et préparons les documents. Séparez les W-2 des 1099. Dans la pile des 1099, triez par variante (NEC, MISC, INT, DIV, K, B). Bien qu'une IA sémantique puisse classer automatiquement les formulaires mixtes, un pré-tri réduit les erreurs de classification. Numérisez les documents papier à 200 ou 300 DPI en niveaux de gris ou en couleur — les niveaux de gris suffisent pour la plupart des formulaires et produisent des fichiers plus légers. Les PDF numériques issus des logiciels de paie sont idéaux car ils évitent complètement les artefacts de numérisation. Retirez toute page de garde, page d'instructions ou page vierge des fichiers avant le téléversement.
2
Définissez vos ensembles de colonnes. Il n'existe pas de préréglage unique pour les formulaires fiscaux, car les W-2 et les 1099 utilisent des correspondances de champs différentes. Définissez plutôt deux ensembles de colonnes : un pour les W-2 et un pour chaque variante de 1099. Pour les W-2, un ensemble de colonnes type : Tax Year, Employee Name, SSN, Employer EIN, Employer Name, Box 1 Wages, Box 2 Fed Tax, Box 3 SS Wages, Box 4 SS Tax, Box 5 Medicare Wages, Box 6 Medicare Tax, Box 12 Codes, Box 12 Amounts, Box 13 Checkboxes, State, State ID, State Wages, State Tax. Pour les 1099-NEC : Tax Year, Recipient Name, Recipient TIN, Payer Name, Payer EIN, Box 1a Nonemployee Comp, Box 1b Cash Tips, Box 4 Fed Tax Withheld, State, State Tax. Avec l'extraction de colonnes personnalisées, vous saisissez ces noms de colonnes comme en-têtes de sortie, et l'IA localise les valeurs correspondantes dans chaque formulaire grâce à la compréhension sémantique — la même définition de colonnes fonctionne sur les W-2 d'ADP, Paychex et Gusto sans modification.
3
Téléversez et traitez par lots. Téléversez tous les formulaires triés en un seul lot. L'outil traite chaque page indépendamment, en appliquant les définitions de colonnes à chaque formulaire. Un lot de 50 W-2 ou 100 1099 prend environ 5 à 15 minutes à traiter. La sortie est un fichier Excel unique avec une ligne par formulaire et les colonnes que vous avez définies. Chaque ligne comprend une colonne de nom de fichier pour retracer les données extraites jusqu'au document source.
4
Vérifiez d'abord les champs à haut risque. Tous les champs n'ont pas le même coût d'erreur. Effectuez une passe de vérification ciblée sur ces champs à haut risque :
  • SSN et EIN — vérifiez chaque caractère par rapport au formulaire source. Un seul chiffre inversé rend les données inutilisables pour la correspondance avec l'IRS.
  • Codes de la Box 12 — confirmez que le code alphabétique correspond au montant en dollars. Le code D (401k) et le code C (assurance-vie collective) se ressemblent dans certaines polices.
  • Lignes multi-états — assurez-vous que les salaires de l'État A ne sont pas appariés avec la retenue d'impôt de l'État B.
  • 1099-NEC Box 1a — avec les nouvelles sous-cases OBBBA (One Big Beautiful Bill Act), vérifiez que la rémunération des non-employés figure en 1a, et non perdue en 1b (pourboires) ou 1d (heures supplémentaires).
La plupart des outils d'extraction permettent de cliquer sur une ligne pour afficher le formulaire original à côté des données extraites. Prévoyez 15 à 30 secondes par formulaire pour cette passe de vérification.
5
Marquez les formulaires exceptionnels pour un traitement séparé. Les formulaires comportant des corrections manuscrites, une mauvaise qualité de numérisation ou des mises en page inhabituelles (comme un W-2 manuscrit d'un employeur domestique) doivent être marqués pour un traitement manuel. Ils représentent généralement moins de 5 % d'un lot, mais exigent le plus grand effort de vérification. Certains systèmes d'extraction vous permettent de marquer une ligne comme « vérifiée » ou « à examiner » — utilisez cette fonction pour suivre les formulaires qui nécessitent encore une attention particulière.
6
Exportez et importez dans le logiciel fiscal. Exportez les données vérifiées au format CSV ou Excel. Mappez les en-têtes de colonnes avec les noms de champs d'importation de votre logiciel fiscal. Chaque application de préparation fiscale exige une dénomination de colonnes spécifique — consultez la section suivante pour les correspondances les plus courantes. Si votre logiciel ne prend pas en charge l'importation CSV, le tableur structuré sert également de feuille de saisie des données qu'un membre du personnel peut utiliser pour saisir les données plus rapidement que de lire les formulaires originaux.

Pour un aperçu plus approfondi de la manière dont l'extraction de données documentaires s'intègre dans les flux de travail comptables plus larges, consultez notre guide couvrant l'ensemble du spectre des documents comptables.

Exportation vers les logiciels de préparation fiscale : mappage des champs

La dernière étape est celle où les flux d'extraction apportent toute leur valeur ou échouent. Tous les logiciels fiscaux ne gèrent pas l'importation CSV de la même manière. Voici les exigences d'importation spécifiques pour les cinq plateformes de préparation fiscale américaines les plus courantes.

Drake Tax

Drake prend en charge l'importation des données W-2 et 1099 via CSV par le biais de son Import Center. L'importation attend des en-têtes de colonnes spécifiques qui correspondent aux noms de champs internes de Drake. Pour les W-2, les mappages clés incluent EMPEIN pour l'EIN de l'employeur, BOX1 pour les salaires, BOX2 pour l'impôt fédéral retenu. Pour le 1099-NEC, l'importation attend PAYERNAME, PAYEREIN, NECBOX1 pour la rémunération des non-employés. Exportez votre résultat d'extraction avec ces en-têtes, et Drake remplira automatiquement les formulaires pour chaque client. Drake prend également en charge le copier-coller direct depuis les cellules de feuille de calcul dans ses écrans de saisie de formulaires, ce qui peut servir de solution de repli si l'importation CSV produit des erreurs de format.

UltraTax CS (Thomson Reuters)

UltraTax CS propose un utilitaire Data Import pour les fichiers CSV. L'importation exige que l'identifiant client soit inclus dans chaque ligne, car UltraTax achemine les données vers la déclaration client correcte en faisant correspondre l'ID. Pour les W-2, le système mappe les champs de l'écran W-2 en faisant correspondre les en-têtes de colonnes — W2_BOX1, W2_BOX2, et ainsi de suite. UltraTax prend également en charge une importation basée sur Excel à l'aide de son modèle de mappage propriétaire, qui est plus flexible mais nécessite une configuration avant le début de la saison fiscale. Thomson Reuters fournit la documentation des conventions exactes de noms de champs dans le système d'aide UltraTax CS sous « Data Import ».

ProSeries (Intuit)

ProSeries prend en charge l'importation W-2 et 1099 via CSV dans sa fonction Importation à partir d'un tableur. Les en-têtes de colonnes doivent correspondre aux noms de champs ProSeries — Intuit fournit un modèle de correspondance téléchargeable (.CSV avec les en-têtes requis) dans le portail d'assistance ProSeries. Pour les 1099, l'importation nécessite une colonne FormType (par exemple, "1099-NEC") afin que le système sache quel formulaire remplir. Le résultat de l'extraction doit inclure cette colonne de classification pour tout lot contenant plusieurs variantes de 1099.

Lacerte (Intuit)

Le flux de travail d'importation de Lacerte utilise son propre Modèle de tableur d'importation. Lacerte permet d'importer plusieurs clients dans un seul fichier d'importation en incluant une colonne d'identifiant client. Pour les W-2, chaque ligne doit contenir l'identifiant client, les données du formulaire et l'année d'imposition. Pour les 1099, le résultat de l'extraction doit être organisé avec une ligne par client et par type de formulaire — un client avec un W-2, un 1099-NEC et un 1099-INT occupera trois lignes dans le fichier d'exportation, chacune étiquetée avec le même identifiant client et l'identifiant de type de formulaire approprié.

ATX et TaxSlayer Pro

ATX et TaxSlayer Pro prennent en charge l'importation CSV avec correspondance de champs. ATX utilise son Gestionnaire d'importation ATX, qui guide à travers un assistant de correspondance étape par étape. TaxSlayer Pro utilise ProForm, qui exige des conventions de nommage de colonnes spécifiques. Pour les deux systèmes, le résultat de l'extraction doit être exporté en CSV simple avec des montants numériques (sans signes dollar ni virgules) et des SSN/EIN formatés en texte (pour préserver les zéros non significatifs).

Règle de formatage applicable à tous les logiciels fiscaux : Exportez les SSN et EIN sous forme de chaînes de texte, pas de nombres. Un zéro non significatif dans un SSN (par exemple, "012-34-5678") sera silencieusement supprimé si la colonne est formatée comme numérique. Exportez les montants en dollars sous forme de nombres simples, sans symboles monétaires ni séparateurs de virgules. Les données des formulaires IRS sont toutes numériques — un formatage superflu entraînera des erreurs d'importation dans tous les principaux systèmes de préparation fiscale.

Sécurité et conformité : ce qu’il faut rechercher dans un outil d’extraction

Les formulaires fiscaux contiennent des numéros de sécurité sociale, des numéros d’identification d’employeur et des données salariales — parmi les informations personnelles les plus sensibles traitées par tout cabinet. Tous les outils d’extraction ne sont pas conçus pour gérer ces données de manière responsable.

Traitement en mémoire. L’outil doit traiter les documents en mémoire et ne pas stocker les fichiers téléchargés sur le disque après l’extraction. Recherchez des déclarations explicites sur la conservation des données — certains outils conservent les fichiers téléchargés pour l’entraînement du modèle, ce qui est inacceptable pour des documents fiscaux contenant des numéros de sécurité sociale.

Chiffrement en transit et au repos. Les téléchargements doivent utiliser HTTPS. Toutes les données stockées (même temporairement) doivent être chiffrées. La plupart des outils d’extraction réputés le proposent, mais vérifiez avant de télécharger les données des clients.

Pas d’entraînement sur vos données. Confirmez que les conditions d’utilisation de l’outil précisent explicitement que les documents téléchargés ne sont pas utilisés pour entraîner ou améliorer le modèle d’IA. C’est un paramètre par défaut courant dans les outils OCR grand public, qui ne convient pas aux documents fiscaux.

Contrôles d’accès. Si l’outil prend en charge l’accès multi-utilisateurs, vérifiez que les utilisateurs ne peuvent voir que leurs propres téléchargements. Un outil partagé où chaque utilisateur voit tous les formulaires téléchargés est un risque de conformité.

Suppression des données. L’outil doit permettre de supprimer définitivement les documents téléchargés et les données extraites, soit automatiquement après une période de conservation (par exemple 24 heures), soit à la demande. Certains cabinets ont des politiques de conservation des documents qui exigent la suppression après le dépôt de la déclaration fiscale.

Questions fréquentes

Quelle précision puis-je attendre pour la case 1 du W-2 (salaires) ?

Sur des W-2 imprimés et nets, scannés à 200+ DPI, la précision de la case 1 est généralement de 93 à 98 %. L’erreur la plus courante est une mauvaise lecture du séparateur décimal — en particulier sur les formulaires où le montant du salaire comporte un point décimal imprimé près des chiffres. Les formulaires manuscrits tombent à 70 à 85 % de précision sur le même champ. La solution n’est pas d’attendre une précision IA de 100 % — c’est de prévoir 15 à 30 secondes de vérification par formulaire pour les champs à haut risque, ce qui représente encore un gain de temps de 80 % par rapport à la saisie manuelle complète.

L'extraction des W-2 et 1099 a-t-elle des problèmes de précision saisonniers ?

Non — le modèle IA fonctionne de manière constante toute l'année. Le facteur saisonnier, c'est le volume. Les cabinets qui traitent 50 W-2 par mois hors saison fiscale en gèrent soudainement 500 par mois de janvier à mars. Le goulot d'étranglement de la vérification est humain, pas technique. Construisez le flux d'extraction avant le début de la saison fiscale — traitez un lot test de 20 formulaires en décembre pour détecter d'éventuels problèmes de type de formulaire avant l'afflux de janvier.

L'IA peut-elle extraire les corrections manuscrites sur les W-2 ?

Partiellement. L'IA lit l'écriture manuscrite avec une précision inférieure à celle du texte imprimé — attendez-vous à 70 à 85 % de précision sur les corrections numériques manuscrites. Les petits employeurs rayent parfois un montant de salaire imprimé et écrivent un chiffre corrigé à la main. Ces formulaires nécessitent une vérification manuelle. Certains outils d'extraction signalent les champs où l'IA a détecté une écriture manuscrite, ce qui facilite l'identification des formulaires nécessitant une attention particulière.

Comment gérer les W-2 multi-états ?

Incluez État, ID État, Salaire État et Impôt État comme colonnes dans votre sortie. Un employé ayant travaillé dans trois États aura trois ensembles de données d'État sur le W-2. L'IA doit regrouper les données de chaque État en un enregistrement distinct — sans mélanger les salaires de l'État A avec l'impôt de l'État B. Après extraction, vérifiez que les lignes d'État sont correctement regroupées en comparant les abréviations d'État avec les montants de salaire. Pour les employés dans des États sans impôt sur le revenu (Floride, Texas, Nevada et sept autres), les champs d'État doivent être vides — ne les signalez pas comme données manquantes.

Comment gérer les 1099 de courtage consolidés ?

Les 1099 consolidés des grands courtiers combinent plusieurs types de formulaires 1099 en un seul document multipage. Les outils d'extraction par IA varient dans leur capacité à segmenter ces documents. Avant de vous lancer dans le traitement par lots, testez votre outil d'extraction sur un relevé consolidé unique. Si l'outil traite l'ensemble du document comme un seul 1099 (au lieu de le segmenter en composants INT/DIV/B/MISC), vous devrez traiter chaque type de formulaire séparément ou utiliser un outil différent pour les relevés consolidés.

Puis-je traiter toutes les variantes 1099 en un seul lot ?

Oui, si l'outil d'extraction classifie automatiquement chaque formulaire en lisant son titre. La sortie doit inclure une colonne « Type de formulaire » pour vérifier la classification. Certains outils le font nativement ; d'autres exigent de trier les 1099 par variante avant l'import. Vérifiez toujours l'auto-classification — un 1099-MISC mal classé comme 1099-NEC produira des correspondances de cases erronées pour chaque champ.

L'extraction peut-elle traiter les W-2 des années antérieures ?

Oui — l'IA lit le formulaire de n'importe quelle année. Ajoutez une colonne « Année fiscale » dans votre sortie d'extraction. Les W-2 antérieurs peuvent utiliser un formatage légèrement différent pour la case 12 ou des polices différentes, mais la numérotation des cases est cohérente d'une année à l'autre. L'IRS a apporté des ajustements mineurs de mise en page en 2020 et 2023 qui ont affecté l'espacement des formulaires, mais pas la numérotation des cases.

Combien de temps l'extraction par IA fait-elle vraiment gagner ?

Pour un professionnel traitant 100 W-2 : la saisie manuelle à 2 à 3 minutes par formulaire prend 200 à 300 minutes (3,3 à 5 heures). L'extraction par IA à 5 à 10 secondes par formulaire plus 15 à 30 secondes de vérification par formulaire prend environ 35 à 50 minutes au total. Soit une réduction de temps de 80 à 85 %. Un cabinet traitant 1 000 formulaires récupère environ 25 à 35 heures par saison fiscale — du temps à rediriger vers la planification fiscale, les déclarations complexes ou le conseil aux clients.

Qu'est-ce qui a changé sur le 1099-NEC 2026 avec l'OBBBA ?

Le One Big Beautiful Bill Act a divisé la case 1 du 1099-NEC en quatre sous-cases : Case 1a (rémunération non salariée), Case 1b (pourboires en espèces), Case 1c (code de profession soumise à pourboires du Trésor) et Case 1d (rémunération des heures supplémentaires). Ces changements prennent effet pour l'année fiscale 2026 (déclarée en 2027). Si votre flux d'extraction a été créé avant 2026, mettez à jour vos définitions de colonnes pour inclure ces nouvelles sous-cases. La rémunération non salariée totale reste dans la case 1a — les cases 1b et 1d sont des ventilations supplémentaires, pas des montants de revenus distincts.

Est-il sûr d'importer des formulaires fiscaux contenant des NASS ?

Cela dépend des pratiques de gestion des données de l'outil. Utilisez uniquement des outils qui traitent les fichiers en mémoire sans stockage à long terme, qui utilisent HTTPS pour les téléchargements et qui précisent explicitement que les documents ne sont pas utilisés pour l'entraînement des modèles. Vérifiez la certification SOC 2 ou ISO 27001 de l'outil si disponible. Pour la plupart des cabinets comptables, un outil d'extraction IA réputé avec des politiques de conservation des données claires est plus sûr que d'envoyer par e-mail des feuilles de calcul contenant des NASS entre les membres du personnel — ce qui est le flux de travail actuel dans de nombreux cabinets.

Arrêtez la saisie manuelle — laissez l'IA lire vos documents
Image ou PDF — données structurées en 10 secondes
Essayer maintenant →

Cet article fait partie d'une série sur l'extraction de documents financiers destinée aux professionnels de la comptabilité :

📮 contact email: [email protected]