Extraction de déclarations HMRC Self Assessment

Extraire les données de la déclaration SA100 vers Excel — Nommez les champs fiscaux, pas les positions des cases

La plupart des extracteurs SA100 sont des plateformes API qui nécessitent un pipeline et un modèle par année avant d'obtenir un tableur — celui-ci lit la SA100 et ses pages supplémentaires selon la signification de chaque case, afin que les mêmes noms de colonnes fonctionnent chaque année. Déposez un PDF et obtenez vos champs en 5 à 10 secondes.

Enterprise-grade security · TLS 1.3 encrypted

PDF et scans papier
XLSX / CSV
UTR et numéro d'assurance nationale
Déclarations par lots

Ce que vous pouvez extraire d'un dossier SA100 britannique

Saisissez les noms de colonnes dont vous avez besoin — l'IA trouve chaque montant sur le formulaire principal ou ses pages supplémentaires en se basant sur la signification du libellé de la case, et non sur son emplacement. Les mêmes colonnes fonctionnent sur un PDF du portail HMRC, un téléchargement TaxCalc et une déclaration papier scannée.

UTR (Unique Taxpayer Reference)
numéro d'assurance nationale
revenus d'emploi (case 1)
intérêts (case 2)
dividendes (case 3)
bénéfices non commerciaux (SA103S)
revenus fonciers (SA105)
revenu total
abattement personnel
revenu imposable
impôt dû
remboursements de prêt étudiant

Vous définissez la sortie — l'IA lit le document. Ajoutez tout champ présent dans les déclarations de vos clients ; la liste ci-dessus constitue l'ensemble de départ dont la plupart des déclarants britanniques ont besoin.

Pourquoi l'extraction SA100 échoue sur la position — et fonctionne sur le sens

La SA100 n'est pas un formulaire unique — c'est un dossier complet. La déclaration principale (TR1–TR6) plus jusqu'à sept pages supplémentaires — SA102 emploi, SA103S non commercial, SA104 société de personnes, SA105 foncier, SA106 étranger, SA108 plus-values, SA109 résidence — alimentent les totaux de la déclaration principale, et chaque logiciel affiche ces cases différemment. Les concurrents résolvent ce problème avec des API d'entreprise et des modèles par année. Voici la différence.

Le problème

01 Un chiffre du formulaire principal a été calculé six pages plus tôt

Les bénéfices imposables de la case 8 du formulaire principal SA100 proviennent du total de la SA103S. Une lecture page par page, isolée, rompt ces liens — et un transcripteur manuel doit naviguer entre les documents pour vérifier que la case correspond à sa source.

02 Cinq rendus placent le même champ à cinq endroits différents

Un téléchargement depuis le portail HMRC, un PDF TaxCalc, un export FreeAgent et une déclaration papier scannée contiennent tous le même UTR et les mêmes cases de revenus — à des coordonnées différentes. Un modèle entraîné sur une mise en page lit mal les autres, ce qui est exactement le problème que les contribuables sur r/UKPersonalFinance décrivent lorsque les champs attendus ne se trouvent pas là où ils ont cherché.

03 HMRC révise la mise en page, et votre modèle meurt avec elle

La mise en page du SA100 change entre les exercices fiscaux, et Making Tax Digital for Income Tax redéfinit la façon dont les déclarations sont déposées. Chaque révision invalide les zones basées sur les coordonnées : une extraction entraînée sur des positions doit donc être retravaillée chaque saison — ou échoue silencieusement sur les déclarations plus anciennes.

Comment l'extraction de colonnes personnalisées résout ce problème

01 Vous nommez le champ ; l'IA le trouve par son sens

Custom Column Extraction signifie que vous saisissez les champs souhaités — « UTR », « impôt dû total », « revenus fonciers » — et l'IA lit chaque case selon le sens de son libellé, où que ce libellé apparaisse dans le dossier. Pas de coordonnées, pas de zones par rendu, pas d'entraînement de modèle.

02 Une définition de colonne couvre tout le dossier

Définissez « bénéfices non commerciaux » une seule fois et il est extrait du SA103S ; définissez « revenus fonciers » et il est lu depuis le SA105 — tandis que le même ensemble capture aussi les revenus d'emploi de la case 1 du formulaire principal. Les pages supplémentaires ne nécessitent ni modèles séparés ni configuration supplémentaire.

03 Aucune maintenance de modèle d'une année à l'autre

Comme l'extraction suit le sens et non la position, les mêmes noms de colonnes continuent de fonctionner lorsque HMRC modifie la mise en page ou qu'un client change de logiciel. La définition de l'année dernière vaut pour cette année — et pour la suivante.

Du dossier SA100 d'un client à un tableur prêt à l'emploi, en trois étapes

Si vous préparez des déclarations d'impôt sur le revenu pour une échéance de janvier — les vôtres ou celles de vos clients — voici à quoi ressemble le flux de travail, de l'importation au tableur dont votre logiciel fiscal (ou votre propre vérification) a réellement besoin.

1

Importez le dossier complet, tel quel

Déposez le SA100 principal ainsi que les pages supplémentaires — SA103S pour les bénéfices non commerciaux, SA105 pour les revenus fonciers — en PDF ou en photos. Les téléchargements du portail HMRC, les fichiers TaxCalc et les déclarations papier scannées peuvent tous être traités dans le même lot ; l'IA n'a pas besoin qu'ils soient pré-triés par outil de génération. Si les clients envoient eux-mêmes leurs fichiers, partagez un Collection Link afin qu'ils les importent directement dans votre file d'attente, sans avoir à s'inscrire.

2

Saisissez les champs fiscaux dont vous avez besoin

Nommez vos colonnes une seule fois : « UTR », « numéro d'assurance nationale », « revenus d'emploi », « bénéfices non commerciaux », « revenus fonciers », « revenu total », « abattement personnel », « revenu imposable », « impôt dû », « remboursements de prêt étudiant ». L'IA lit chaque case selon le sens de son libellé et remplit la ligne — sur toutes les pages du dossier. Ajoutez une colonne calculée comme « Solde (impôt dû − acomptes provisionnels) » et le calcul s'exécute pendant l'extraction.

3

Téléchargez un Excel par déclaration — ou une ligne par client

Exportez en XLSX ou CSV. Traitez un lot de déclarations et chacune devient une ligne : UTR dans la première colonne, revenus et montants d'impôt dans leurs colonnes nommées, prêts à être rapprochés de vos livres comptables ou transmis au logiciel de dépôt. Le mode Vérification met en évidence la provenance de chaque valeur sur la page d'origine, ce qui rend la vérification ponctuelle rapide, sans avoir à relire six pages.

Quand l'outil est le plus performant — et quand vérifier les résultats

Quand l'outil est le plus performant

SA100 numériques et scannés proprement. Les PDF du portail HMRC, les déclarations générées par des logiciels comme TaxCalc ou FreeAgent, et les scans à plat à 200–300 DPI sont extraits avec une grande précision, car les libellés des cases sont imprimés mécaniquement.

Dossiers multipages avec pages supplémentaires. Les chiffres SA103S (travail non salarié) et SA105 (revenus fonciers) sont extraits en même temps que le formulaire principal, en une seule passe — les rubriques dont la plupart des déclarants britanniques ont besoin.

Traitement par lots des déclarations clients. Importez plusieurs SA100 à la fois et exportez un seul tableur avec une ligne par déclaration — le format qui rend le rapprochement de janvier pratique.

Quand faire preuve de prudence

Écriture manuscrite importante ou images de mauvaise qualité. Les cases remplies à la main réduisent la précision, et les photos prises avec un téléphone, ombragées ou inclinées, peuvent flouter les petits caractères des pages supplémentaires. Un scan propre donne toujours de meilleurs résultats qu'une photo prise à la hâte.

L'outil extrait des données — il ne dépose pas votre déclaration. L'outil produit le tableur structuré ; la soumission à HMRC passe toujours par votre logiciel de déclaration. Vérifiez les chiffres avant de les intégrer à une soumission.

Les cases vides restent vides. L'IA extrait ce qui est imprimé. Si une déclaration ne comporte effectivement aucun revenu foncier, la colonne « revenus fonciers » reste vide — l'outil ne devine pas et ne va pas chercher un chiffre ailleurs.

Questions fréquentes

Puis-je extraire des données d'un SA100 papier scanné ?

Oui, tant que le texte imprimé est lisible à l'œil nu. L'IA lit les libellés de champs comme « Total Tax Due » et « UTR » par leur sens plutôt que par leurs coordonnées, donc une déclaration papier scannée est traitée de la même manière qu'un PDF du portail HMRC. Un scan à plat propre de 200 à 300 DPI donne les meilleurs résultats ; si vous ne disposez que d'une photo de téléphone avec des ombres, prévoyez de vérifier les chiffres en petits caractères des pages supplémentaires en mode Vérification.

Faut-il une configuration distincte pour les pages supplémentaires comme SA103S ou SA105 ?

Non. Un seul jeu de noms de colonnes couvre l'ensemble du dossier. Définissez « Self-Employment Profit » et l'IA le trouve sur SA103S ; définissez « Property Income » et elle lit SA105 — tandis que les mêmes colonnes capturent également les revenus d'emploi de la case 1 et les dividendes de la case 3 du formulaire principal. Comme l'extraction suit le sens des cases, aucun modèle par page supplémentaire n'est à créer ni à maintenir.

Puis-je extraire seulement quelques champs — par exemple UTR et Total Tax Due — au lieu de tout ?

C'est exactement ainsi que cela fonctionne. Custom Column Extraction signifie que vous n'obtenez que les colonnes que vous nommez : saisissez « UTR » et « Total Tax Due » et le tableau de sortie contient ces deux colonnes et rien d'autre. C'est la différence entre cet outil et les extracteurs d'API à schéma fixe, qui renvoient un ensemble de champs prédéfini que vous devez ensuite filtrer. Définissez deux champs ou vingt — l'IA ne lit que ce que vous demandez.

Cela fonctionnera-t-il toujours quand HMRC modifiera la mise en page du formulaire, ou dans le cadre de MTD for ITSA ?

Oui. Les modèles basés sur la position se brisent lorsque HMRC révise la mise en page ou lorsqu'une déclaration provient d'un autre logiciel de rendu — c'est la charge de maintenance que les plateformes concurrentes vous transfèrent. L'extraction basée sur le sens ne dépend pas des coordonnées, donc les mêmes définitions de colonnes continuent de fonctionner à travers les révisions de mise en page. Et comme elle lit les documents historiques de la même manière, les anciens SA100 restent extractibles après que Making Tax Digital for Income Tax aura changé la façon dont les nouvelles déclarations sont déposées.

Quelle est la précision sur les déclarations manuscrites ou imparfaites ?

Les champs SA100 imprimés sont extraits avec une très haute précision — c'est le cas courant pour les déclarations générées par le portail HMRC et les logiciels. L'écriture manuscrite est la limite honnête : les chiffres clairement écrits sont bien extraits, mais une écriture petite, rapide ou maculée sur les pages supplémentaires peut réduire la précision sur certaines valeurs. Pour toute déclaration manuscrite, ou lorsque les chiffres d'un client sont inhabituels, utilisez le mode Vérification pour voir exactement quelle partie de la page d'origine correspond à chaque valeur extraite avant que les chiffres ne soient utilisés.

📮 contact email: [email protected]