Extração de Schedule K-1Onde as caixas são a parte fácil

Todo K-1 tem cerca de vinte caixas numeradas, e depois de anos de melhorias em OCR, colocar essas caixas em uma planilha é um problema quase resolvido. O trabalho que ainda consome a semana de um preparador está por trás delas. O Schedule K-3, o valor em risco, os itens codificados na Box 11 e uma pilha de linhas de ajuste estaduais carregam os números que realmente mudam uma declaração, e são exatamente os valores que uma ferramenta genérica de extração descarta por padrão.

Pare de digitar dados — deixe a IA ler por você
Envie uma imagem ou PDF — dados estruturados em 10 segundos
Experimente agora →
Imagem de destaque da extração de Schedule K-1 com título e três ícones mostrando caixas padrão resolvidas, códigos desacoplados e valores dispersos

Principais Conclusões

  1. Vinte caixas em cada K-1, e colocar essas caixas em uma planilha é a parte que já funciona.
  2. Os valores que realmente mudam uma declaração estão por trás das caixas, no Schedule K-3, na declaração de at-risk e nos cronogramas estaduais.
  3. Nomeie o valor desejado como uma coluna e a IA lê o pacote inteiro para encontrá-lo.

As Caixas Padrão do K-1 Estão Resolvidas. O Resto Não Está.

A extração das caixas padrão funciona porque cada caixa é autossuficiente. A Box 1 de renda ordinária de negócios, a Box 2 de aluguel líquido de imóveis, a Box 5 de juros, a Box 6a de dividendos ordinários e as porcentagens de lucro, perda e capital ficam todas na face do formulário com um rótulo e um valor ao lado. Um modelo de visão pode lê-las em um K-1 de parceria, um K-1 de S-corp ou um K-1 de trust sem um modelo, porque o rótulo carrega o significado e o valor fica ao lado dele. Este é o trabalho que extrair as caixas padrão do K-1 para uma planilha já lida bem. É também o que a maioria das ferramentas de extração de dados de K-1 anuncia, e na face do formulário elas fazem isso com competência.

O IRS contou mais de 4,5 milhões de declarações de parceria e 30,2 milhões de sócios para o ano fiscal de 2023, e somente a atividade de imóveis e aluguéis representou 50,7 por cento dessas parcerias. O volume de K-1s em circulação não é o problema. O problema é a parte de cada pacote que nunca chega à página de rosto.

Essa parte tem uma forma. É a parte de um pacote de K-1 onde o valor que você precisa não está rotulado no formulário, é relatado como um código em vez de um valor em dólares, é limitado por uma regra que depende de fatos que o formulário não contém, ou vive em um cronograma estadual separado que reutiliza os números das caixas federais para valores totalmente diferentes. Quando você vê esses itens como uma categoria, o motivo pelo qual a extração padrão continua perdendo-os fica óbvio.

Os Cinco Itens do K-1 Que Silenciosamente Somem de uma Planilha

Cinco itens do K-1 que silenciosamente somem de uma planilha listados com selos numerados

Essas cinco categorias são responsáveis pela maior parte do retrabalho em uma temporada com muitas parcerias, e nenhuma delas é capturada de forma confiável por uma ferramenta que lê apenas a página de rosto.

1. Schedule K-3 e os formulários estrangeiros que ele aciona

O Schedule K-3 reporta os itens internacionais de uma parceria e não possui valor em dólar impresso no K-1 que o acompanha. É um cronograma separado com treze partes. A Parte II contém os itens de limitação do crédito de imposto estrangeiro, incluindo uma linha de USGI para juros do governo dos EUA. A Parte VI contém inclusões de sociedades estrangeiras controladas sob as seções 951(a) e 951A. A Parte VII contém dados de empresas de investimento passivo estrangeiro. As instruções do IRS afirmam que a Parte VI alimenta Formulário 5471, a Parte VII alimenta o Formulário 8621, e o relatório de parceria estrangeira ou filial pode exigir o Formulário 8865 e o Formulário 8858. Uma transferência de propriedade para uma corporação estrangeira pode exigir o Formulário 926.

Para uma parceria doméstica sem atividade estrangeira, um requisito de K-3 devidamente formado pode não aparecer. Mas a exceção de arquivamento doméstico é estreita: uma solicitação de parceiro até a data de um mês, que o IRS definiu como 17 de agosto de 2026 para parcerias do ano fiscal de 2025 em calendário que arquivam com prorrogação, pode transformar uma declaração em uma obrigação completa de arquivamento (Instruções de Parceria para os Schedules K-2 e K-3). Quando isso acontece, o K-3 chega atrasado e cada número nele tem que ser alocado em algum lugar na declaração do parceiro.

2. O valor em risco

O valor em risco que um parceiro precisa não é uma caixa no K-1. Sob a seção 465, uma perda é dedutível apenas até o valor que o parceiro poderia realmente perder, e esse valor exclui financiamento sem recurso e valores protegidos por garantia ou acordo de stop-loss. A parceria é obrigada a fornecer uma declaração separada de receitas e despesas para cada atividade em risco, e a Box 22 do K-1 é marcada quando mais de uma atividade está envolvida. O IRS combina isso com Formulário 6198, Limitações de At-Risk, que reconcilia base e valores em risco. Se sua planilha extraída parar na Box 1, você tem a perda, mas não o teto sobre ela.

A base vem primeiro, o at-risk em segundo, o passivo em terceiro e a perda comercial excessiva em quarto. Uma perda que ultrapassa a base externa ainda pode ser suspensa na etapa de at-risk, e esse valor suspenso é um arrastamento que o próximo ano precisa assumir. Ler o valor de um único K-1 não é suficiente para calculá-lo.

3. Código S da Box 11 e o caráter da seção 1231

A Box 11 informa outros rendimentos e perdas por código de letra, e a letra determina o tratamento tributário, não o valor. O código S, geralmente escrito como 11S nas telas de entrada de software tributário, é ganho ou perda de capital não relacionado à carteira, o resultado líquido de curto e longo prazo da alienação de propriedade usada em um comércio ou negócio. Ele não pertence ao Schedule E como rendimento ordinário. Ele flui para o Schedule D, e a regra de look-back da seção 1231 pode reclassificar o ganho líquido da seção 1231 como rendimento ordinário na medida das perdas não recuperadas dos cinco anos anteriores. Uma extração que captura o número na Box 11 e ignora o código perde a única informação que diz ao preparador para onde o número vai.

4. Linhas do K-1 estadual, incluindo USGI

Um K-1 estadual reutiliza os números de box federais para valores diferentes, porque os valores estaduais são rateados. Vários estados também informam linhas para as quais o K-1 federal não tem equivalente. Juros de títulos do governo dos EUA, frequentemente abreviados como USGI, são o exemplo mais claro: o governo federal proíbe os estados de tributar juros sobre obrigações dos EUA, então estados como Colorado, Oregon e Nebraska incluem uma linha de subtração ou dedução para isso em seus cronogramas de parceria. Se um lote mistura K-1s federais e estaduais e a ferramenta se baseia apenas nos números de box, os valores estaduais são contados em dobro nos totais federais.

5. Valores que exigem trabalho entre páginas ou entre anos

Os componentes de renda qualificada de negócio da seção 199A, alocações corretivas da seção 704(c), ajustes da seção 743(b) e arrastamentos de anos anteriores têm isto em comum: o número que você realmente precisa não aparece como um único valor impresso em nenhuma página. Um preparador o reconstrói a partir da declaração por trás do código, do papel de trabalho do ano anterior ou de uma premissa fixa. Uma ferramenta de extração que apenas copia o que consegue ver sempre retornará uma resposta parcial aqui.

Por que as ferramentas de extração não detectam estes itens

Existem três razões estruturais que explicam esta lacuna, e nenhuma delas está relacionada à qualidade da digitalização. A primeira é que os códigos e os montantes estão desvinculados. A Box 11 mostra uma letra; a cifra em dólares está em uma declaração anexa, às vezes a páginas de distância. Uma ferramenta que lê o formulário principal captura o código e não retorna nenhun valor.

A segunda é o fluxo de trabalho do software. Os profissionais relatam que os dados K-2 e K-3 não são preenchidos a partir do Schedule K concluído no software tributário convencional, portanto, o preparador os reinsere manualmente nas telas de entrada do K1. Um revisor descreveu o primeiro K-3 que preparou desta maneira: "Concluí o meu primeiro na semana passada (1120S) e foi horrível. Tudo inserido manualmente." Este comentário, do tema K-2/K-3 do r/taxpros, é a mesma queixa no UltraTax CS, Lacerte, CCH Axcess e Drake: a etapa manual persiste porque os dados não têm de onde fluir.

A terceira é que alguns campos são frequentemente omitidos até mesmo pelos produtos de extração. Um usuário de automação K-1 de longa data resumiu isso no tema de automação do r/taxpros: "Exportará cada campo de cada K-1, exceto QBI e USGI." Os dois campos que determinan a dedução e a subtração estatal eram os dois que a ferramenta deixava de lado.

Como extraer os dados por trás das Boxes

Comparação em três colunas dos modos de extração: extração direta, colunas calculadas e colunas inferidas

A solução é parar de tratar a extração como "ler o formulário" e começar a tratarla como "describir o valor que você deseja". É isso que Extraction de Colunas Personalizadas faz: você digita os nomes das colunas que deseja, e a IA localiza cada valor ao compreender o que ele significa, não ao corresponder a uma posição fixa. Você não está restringido aos campos que existem como boxes. Um nome de coluna pode descrever um valor disperso em várias páginas, um valor calculado a partir de outros valores ou um valor que a IA precisa inferir.

Os três modos se mapean diretamente às cinco categorias de itens omitidos acima.

1

Extração direta para linhas K-3 e estaduais

Uma coluna chamada K-3 Part II Line 5 USGI ou NY Allocated Income instrui a IA a localizar essa linha específica e retornar o valor, mesmo quando ele está em um anexo várias páginas atrás do K-1. Como o nome da coluna carrega a instrução, um único conjunto de nomes funciona para todos os tipos de entidade no lote. Este é o modo que recupera os valores da Parte VI e Parte VII do K-3 que alimentam o Formulário 5471 e o Formulário 8621, e as linhas de subtração estaduais que o formulário federal nunca exibe.

2

Colunas calculadas para cálculos de risco e arrastamento

Uma coluna calculada executa a aritmética durante a extração e gera o resultado como uma nova coluna. Deductible Loss (Box 1 Loss - Prior-Year At-Risk Carryforward) retorna o valor dedutível em vez de dois números brutos que você subtrairia depois. Um parâmetro fixo pode ser incorporado à regra, de modo que uma alíquota ou um arrastamento que nunca aparece no documento ainda entre no cálculo. É assim que uma planilha pode carregar o teto de risco, não apenas a perda.

3

Colunas inferidas para o sinalizador de acompanhamento

Uma coluna inferida retorna informações que o documento não declara diretamente. Defina Follow-Up Needed (options: K-3 request, Form 5471, Form 8621, At-Risk Statement, None) e a IA lê o pacote e classifica o que cada linha exige. A planilha de saída então carrega um sinalizador do preparador ao lado dos valores, para que a pessoa que revisa a declaração veja qual cliente precisa de qual formulário antes do envio, em vez de descobrir isso no final da temporada.

JPG/PNG/PDF Extração por IA

Os arquivos são processados com segurança e não são armazenados.

O processamento em lote é tão importante quanto o modo de coluna aqui, porque o problema de itens descartados é um problema de volume. Quando um cliente possui K-1s de uma dúzia de entidades, ou um administrador de fundos tem centenas de sócios, a extração precisa ser executada em todo o conjunto e mesclada em um único arquivo Excel ou CSV. É aí que o sinalizador de acompanhamento ganha seu lugar: a fila de revisão se torna um filtro em uma coluna, em vez de uma busca página por página.

O Que Isso Não Consegue Fazer Automaticamente

Alguns detalhes do K-1 estão genuinamente fora do que qualquer etapa de extração deveria ser confiável para resolver sozinha, e vale a pena ser direto sobre quais. As notas de rodapé narrativas são as principais. Quando um fundo esconde um ajuste da seção 743(b) ou um componente de renda qualificada de negócio dentro de um parágrafo denso em vez de uma tabela, um número pode ser lido, mas seu significado pode ser mal interpretado. Trate essas linhas como candidatas a revisão, não como definitivas.

K-1s alterados e substitutos são um segundo caso. Eles podem mostrar tanto um valor original quanto um corrigido para a mesma caixa, às vezes com uma marca d'água. A extração retorna o que lê, então o preparador ainda precisa confirmar que o valor corrigido é o que preencheu a linha. Digitalizações de baixa resolução abaixo de cerca de 150 dpi são um terceiro caso: parênteses tênues em torno de uma perda podem ser lidos como um número positivo, e um sinal de menos comprimido pode desaparecer.

Por fim, esta ferramenta não importa diretamente para CCH Axcess, UltraTax CS, Lacerte, ou Drake. Ela exporta Excel, CSV ou JSON. Levar os dados para o seu software tributário é uma etapa de mapeamento que você ou sua empresa controla, que é o limite honesto de uma camada de extração nativa de planilhas.

Para Onde os Dados Extraídos Vão em Seguida

A saída é uma pasta de trabalho estruturada, e a forma como você a usa depende do tamanho da operação. Um preparador individual coloca a coluna Follow-Up Needed em um filtro e trabalha as exceções primeiro. Uma empresa com uma temporada de K-1 maior pode manter o arquivo extraído como a camada intermediária da qual cada declaração se baseia, o que se encaixa no padrão mais amplo descrito em este guia de extração de documentos para contadores e em o caso para software de extração em escritórios de contabilidade.

A mesma camada intermediária é o que mantém um fluxo de trabalho de temporada unido quando K-1s, W-2s e 1099s chegam nas mesmas semanas. Se esse problema de coleta e roteamento de ponta a ponta é o que está diante de você, a abordagem de pipeline para a temporada de impostos é a próxima leitura natural.

Perguntas Frequentes

A IA consegue extrair dados do Schedule K-3, ou apenas os campos do K-1?

Ela consegue extrair linhas do K-3, desde que você as nomeie. Em vez de ler um layout fixo, a IA segue um nome de coluna como "K-3 Part VI Subpart F Inclusion" ou "K-3 Part VII PFIC Section 1291 Amount" até a linha correta no formulário. O limite é que o K-3 é um documento separado de várias páginas, então ele precisa fazer parte do mesmo pacote enviado junto com o K-1 ao qual pertence.

Por que não posso simplesmente ler o valor em risco diretamente do K-1?

Porque ele não é impresso ali. De acordo com a seção 465, o valor em risco depende de quanto do investimento o sócio poderia realmente perder, o que exclui financiamento sem recurso e valores garantidos ou protegidos por stop-loss. A parceria fornece uma declaração separada por atividade, e o sócio a reconcilia no Formulário 6198. Você pode extrair os componentes brutos e deixar uma coluna calculada fazer a subtração, mas o teto em si é um cálculo, não um campo.

Como vocês lidam com K-1 estaduais que reutilizam os números dos campos federais?

Mantenha valores estaduais e federais em colunas separadas e nunca deixe que um número de campo sozinho identifique um valor. Uma coluna chamada "CA Allocated Interest" é inequívoca; uma coluna chamada "Box 5" não é, porque o Box 5 federal e um Box 5 estadual são valores diferentes por definição. Colunas nomeadas eliminam a ambiguidade antes do início da extração.

Esta ferramenta se conecta ao CCH Axcess, UltraTax CS, Lacerte ou Drake?

Não diretamente. Ela gera Excel, CSV ou JSON, e sua empresa mapeia esse arquivo no software de impostos usando o caminho de importação que já utiliza. Isso é proposital: uma camada nativa de planilhas evita prendê-lo a uma única plataforma de preparação de impostos e mantém os dados extraídos inspecionáveis antes de chegarem à declaração.

Posso extrair K-1s junto com W-2s e 1099s em um único lote?

Sim. Tipos de documentos mistos são processados juntos, e cada linha carrega seu tipo de documento para que você possa filtrar o arquivo consolidado. Isso é útil quando a declaração de um único cliente depende de parcerias, renda de emprego e extratos de corretagem que chegam todos dentro das mesmas poucas semanas.

As caixas nunca foram a parte difícil de um K-1. A parte difícil é a camada por trás delas, as partes K-3, o limite em risco, os códigos de letras e as linhas estaduais, e essa camada só é invisível até você decidir nomeá-la como uma coluna. Uma vez que é uma coluna, deixa de ser algo que uma declaração silenciosamente esquece.

Nomeie o valor do K-1 que você precisa, incluindo aqueles que ficam atrás das caixas, e deixe a extração devolvê-lo como uma coluna que você pode revisar.

Teste em um pacote de K-1 da sua própria temporada, idealmente um com um K-3 e um anexo estadual, e veja se a coluna de acompanhamento corresponde ao que seu processo de revisão teria sinalizado manualmente. Experimente com seus próprios K-1s.

📮 contact email: [email protected]