Extraire les données de la déclaration SA100 vers Excel — Nommez les champs fiscaux, pas les positions des cases
La plupart des extracteurs SA100 sont des plateformes API uniquement qui nécessitent un pipeline et un modèle annuel avant d'obtenir un tableur — celui-ci lit la SA100 et ses pages supplémentaires selon la signification de chaque case, afin que les mêmes noms de colonnes fonctionnent chaque année. Déposez un PDF et obtenez vos champs en 5 à 10 secondes.
Enterprise-grade security · TLS 1.3 encrypted
Ce que vous pouvez extraire d’un dossier SA100 du Royaume-Uni
Saisissez les noms des colonnes dont vous avez besoin — l’IA trouve chaque montant sur le formulaire principal ou ses pages supplémentaires selon la signification de l’étiquette, et non son emplacement. Les mêmes colonnes fonctionnent sur un PDF du portail HMRC, un téléchargement TaxCalc et une déclaration papier scannée.
Vous définissez la sortie — l'IA lit le document. Ajoutez tout champ présent dans les déclarations de vos clients ; la liste ci-dessus est l'ensemble de départ dont la plupart des déclarants au Royaume-Uni ont besoin.
Pourquoi l'extraction SA100 échoue sur la position — et fonctionne sur le sens
Le SA100 n'est pas un formulaire unique — c'est un dossier complet. La déclaration principale (TR1–TR6) plus jusqu'à sept pages supplémentaires — SA102 emploi, SA103S non commercial, SA104 société de personnes, SA105 foncier, SA106 étranger, SA108 plus-values, SA109 résidence — alimentent les totaux du formulaire principal, et chaque logiciel affiche ces cases différemment. Les concurrents résolvent ce problème avec des API d'entreprise et des modèles par année. Voici la différence.
Le problème
Les bénéfices imposables de la case 8 du formulaire principal SA100 proviennent du total de la SA103S. Lire page par page sans lien rompt ces connexions — et un transcripteur manuel doit sauter entre les documents pour vérifier que la case correspond à sa source.
Un téléchargement depuis le portail HMRC, un PDF TaxCalc, une exportation FreeAgent et une déclaration papier scannée contiennent tous le même NIF et les mêmes cases de revenus — mais à des coordonnées différentes. Un modèle entraîné sur une mise en page ne reconnaît pas les autres, ce qui est exactement le problème rencontré par les contribuables sur r/UKPersonalFinance qui décrivent des champs introuvables là où ils les attendaient.
La mise en page du SA100 change entre les exercices fiscaux, et Making Tax Digital pour l'impôt sur le revenu transforme la façon dont les déclarations sont déposées. Chaque révision invalide les zones basées sur des coordonnées, obligeant à réentraîner l'extraction à chaque saison — ou à échouer silencieusement sur les déclarations plus anciennes.
Comment l'extraction de colonnes personnalisées résout ce problème
L'extraction de colonnes personnalisées signifie que vous saisissez les champs souhaités — « UTR », « Impôt total dû », « Revenus fonciers » — et l'IA lit chaque case selon la signification de son libellé, où que ce libellé apparaisse dans le document. Pas de coordonnées, pas de zones par rendu, pas d'entraînement de modèle.
Définissez « Bénéfices non salariés » une fois et cela s'applique au formulaire SA103 ; définissez « Revenus fonciers » et cela lit le SA105 — tandis que le même ensemble capture aussi le revenu d'emploi de la case 1 du formulaire principal. Les pages supplémentaires ne nécessitent ni modèles séparés ni configuration additionnelle.
Parce que l'extraction suit la signification, et non la position, les mêmes noms de colonnes continuent de fonctionner lorsque le HMRC modifie la mise en page ou lorsqu'un client change de logiciel. La définition de l'année dernière fonctionne cette année — et l'année prochaine.
Du dossier SA100 d'un client à une feuille de calcul prête, en trois étapes
Si vous préparez des déclarations d'impôt sur le revenu pour une échéance de janvier — les vôtres ou celles de vos clients — voici à quoi ressemble le flux de travail, de l'import à la feuille de calcul dont votre logiciel fiscal (ou votre propre vérification) a réellement besoin.
Importez le dossier complet, tel quel
Déposez le SA100 principal ainsi que les pages supplémentaires — SA103S pour les bénéfices non commerciaux, SA105 pour les revenus fonciers — en PDF ou en photos. Les téléchargements du portail HMRC, les fichiers TaxCalc et les déclarations papier scannées peuvent tous être traités dans le même lot ; l'IA n'a pas besoin qu'ils soient pré-triés par outil de génération. Si les clients envoient eux-mêmes les fichiers, partagez un Collection Link pour qu'ils les importent directement dans votre file d'attente sans s'inscrire.
Saisissez les champs fiscaux dont vous avez besoin
Nommez vos colonnes une seule fois : « UTR », « numéro d'assurance nationale », « revenus d'emploi », « bénéfices non commerciaux », « revenus fonciers », « revenu total », « abattement personnel », « revenu imposable », « impôt dû », « remboursements de prêt étudiant ». L'IA lit chaque case selon le sens de son libellé et remplit la ligne — sur toutes les pages du dossier. Ajoutez une colonne calculée comme « Solde (impôt dû − acomptes) » et le calcul s'exécute pendant l'extraction.
Téléchargez un Excel par déclaration — ou une ligne par client
Exportez en XLSX ou CSV. Traitez un lot de déclarations et chacune devient une ligne : UTR dans la première colonne, revenus et impôts dans leurs colonnes nommées, prêts à rapprocher de vos comptes ou à transmettre au logiciel de dépôt. Le mode Vérification met en évidence la provenance de chaque valeur sur la page d'origine, ce qui rend la vérification ponctuelle rapide au lieu de relire six pages.
Quand ça fonctionne le mieux — et quand vérifier le résultat
Quand ça fonctionne le mieux
Déclarations SA100 numériques et bien scannées. Les PDF du portail HMRC, les déclarations générées par logiciel comme TaxCalc ou FreeAgent, et les scans à plat à 200–300 DPI sont extraits avec une grande précision, car les cases sont imprimées.
Dossiers multipages avec annexes. Les chiffres des annexes SA103S (travail indépendant) et SA105 (revenus fonciers) sont extraits en même temps que le formulaire principal — les champs dont la plupart des déclarants au Royaume-Uni ont besoin.
Traitement par lots des déclarations clients. Importez plusieurs SA100 à la fois et exportez un seul tableur avec une ligne par déclaration — la forme qui rend le rapprochement de janvier pratique.
Quand être prudent
Déclarations très manuscrites ou images de mauvaise qualité. Les cases remplies à la main réduisent la précision, et les photos prises en biais ou dans l'ombre peuvent rendre flous les petits caractères des annexes. Un scan propre donne toujours de meilleurs résultats qu'une photo prise à la hâte.
Cet outil extrait des données — il ne dépose pas votre déclaration. Il produit le tableur structuré ; la soumission à HMRC passe toujours par votre logiciel de dépôt. Vérifiez les chiffres avant de les intégrer à une soumission.
Les cases vides restent vides. L'IA extrait ce qui est imprimé. Si une déclaration n'a réellement aucun revenu foncier, la colonne Revenus fonciers reste vide — elle ne devine pas et n'invente pas de chiffre.
Questions fréquentes
Puis-je extraire des données d'un SA100 papier scanné ?
Oui, tant que le texte imprimé est lisible à l'œil nu. L'IA lit les libellés de champs comme « Total Tax Due » et « UTR » selon leur signification plutôt que leurs coordonnées, donc une déclaration papier scannée est traitée de la même manière qu'un PDF du portail HMRC. Un scan à plat propre de 200 à 300 DPI donne les meilleurs résultats ; si vous ne disposez que d'une photo de téléphone avec des ombres, prévoyez de vérifier les chiffres en petits caractères des pages supplémentaires en mode Vérification.
Ai-je besoin d'une configuration séparée pour les pages supplémentaires comme SA103S ou SA105 ?
Non. Un seul ensemble de noms de colonnes couvre tout le dossier. Définissez « Self-Employment Profit » et l'IA le trouve sur SA103S ; définissez « Property Income » et elle lit SA105 — tandis que les mêmes colonnes capturent également les revenus d'emploi de la case 1 et les dividendes de la case 3 du formulaire principal. Comme l'extraction suit la signification des cases, il n'y a aucun modèle par page supplémentaire à créer ou à maintenir.
Puis-je extraire seulement quelques champs — par exemple UTR et Total Tax Due — au lieu de tout ?
C'est exactement comme cela que cela fonctionne. Custom Column Extraction signifie que vous n'obtenez que les colonnes que vous nommez : saisissez « UTR » et « Total Tax Due » et le tableau de sortie contient ces deux colonnes et rien d'autre. C'est la différence entre cet outil et les extracteurs API à schéma fixe, qui renvoient un ensemble de champs prédéfini que vous devez ensuite filtrer. Définissez deux champs ou vingt — l'IA ne lit que ce que vous demandez.
Cela fonctionnera-t-il toujours lorsque HMRC modifiera la mise en page du formulaire, ou dans le cadre de MTD for ITSA ?
Oui. Les modèles basés sur la position cassent lorsque HMRC révise la mise en page ou lorsqu'une déclaration provient d'un autre logiciel de rendu — c'est la charge de maintenance que les plateformes concurrentes vous transmettent. L'extraction basée sur la signification ne dépend pas des coordonnées, donc les mêmes définitions de colonnes continuent de fonctionner à travers les révisions de mise en page. Et comme elle lit les documents historiques de la même manière, les SA100 passées restent extractibles après que Making Tax Digital for Income Tax change la façon dont les nouvelles déclarations sont déposées.
Quelle est la précision sur les déclarations manuscrites ou imparfaites ?
Les champs SA100 imprimés s'extraient avec une très haute précision — c'est le cas courant pour les déclarations générées par le portail HMRC et les logiciels. L'écriture manuscrite est la limite honnête : les chiffres clairement écrits s'extraient bien, mais une écriture petite, rapide ou maculée sur les pages supplémentaires peut réduire la précision sur certaines valeurs. Pour toute déclaration manuscrite, ou lorsque les chiffres d'un client sont inhabituels, utilisez le mode Vérification pour voir exactement quelle partie de la page originale chaque valeur extraite provient avant que les chiffres n'aillent où que ce soit.