Multi-Page Merge combina os resultados extraídos que pertencem ao mesmo documento em um único registro. Quando um documento é enviado como vários arquivos — a frente e o verso de um cartão de identidade fotografados separadamente, um extrato bancário dividido em páginas, um contrato digitalizado em partes — cada arquivo é processado individualmente e produz seus próprios resultados. Ativar o Multi-Page Merge informa ao aplicativo como reconhecer quais linhas pertencem ao mesmo grupo e como combiná-las em um único grupo de mesclagem.
Por que o mesmo documento pode aparecer como várias linhas
Cada arquivo enviado é processado de forma independente e produz seu próprio resultado. Um único envio pode, por si só, produzir várias linhas — uma página de extrato bancário pode conter uma dúzia de transações, cada uma se tornando sua própria linha. Portanto, um documento que chega como três arquivos não produz uma linha de resultados; produz três conjuntos separados de linhas, um por arquivo.
Casos comuns em que um documento é dividido entre arquivos incluem:
- Um cartão de identidade fotografado como duas imagens: a frente contém o nome e o número de identificação, o verso contém o endereço e a data de validade.
- Um extrato bancário que se estende por várias páginas: o número da conta aparece uma vez no topo da página 1, enquanto a tabela de transações continua nas páginas seguintes.
- Um contrato de várias páginas digitalizado página por página, onde um número de contrato ou um bloco de assinatura aparece apenas em algumas das páginas.
O Multi-Page Merge trabalha com linhas, não páginas. Primeiro, ele decide quais linhas pertencem ao mesmo grupo, depois combina os valores em cada grupo. As regras de agrupamento são salvas em um modelo, portanto, uma vez configuradas, elas se aplicam a cada lote processado com esse modelo.
Três maneiras de agrupar arquivos em um registro
Nas configurações do modelo, você escolhe exatamente um dos três modos de mesclagem. Cada um responde à mesma pergunta — "quais resultados pertencem juntos?" — de uma maneira diferente.
Sequential Merge
Este modo lê seus arquivos na ordem de upload. Enquanto uma coluna escolhida permanecer vazia ou igual, esses arquivos permanecem juntos como um registro. No momento em que a coluna mostra um valor novo e diferente, um novo registro começa a partir daí. Isso é adequado para documentos onde um valor de identificação aparece uma vez — por exemplo, um número de fatura impresso apenas na página 1, ou um nome que aparece no topo de cada contrato.
Ao escolher Sequential Merge, você também escolhe Where to break — a condição que inicia um novo registro. Break on value change é selecionado por padrão.
| Condição de quebra | O que inicia um novo registro |
|---|---|
| Break on value change (padrão) | Os arquivos são seguidos na ordem de upload. Enquanto a coluna escolhida estiver vazia ou inalterada, eles permanecem no mesmo registro. O primeiro arquivo onde a coluna mostra um valor diferente inicia um novo registro. |
| Break on a blank item | Um arquivo onde todas as colunas retornam completamente vazias é tratado como um separador. Tudo antes dele se torna um registro, e o arquivo logo após ele inicia um novo. |
| Break when a value appears | O arquivo onde a coluna escolhida tem qualquer conteúdo pela primeira vez — não importa o que seja — inicia um novo registro. Útil para um carimbo, uma marca de verificação ou qualquer campo cuja presença indica um novo documento. |
| Break on a specific value | O arquivo onde a coluna escolhida corresponde ao texto ou padrão que você inserir inicia um novo registro. Texto simples funciona como está; um padrão como INV-\d+ corresponde a um formato em vez de um valor fixo. |
Match by Value
Este modo ignora a ordem de upload. Quaisquer arquivos que compartilhem o mesmo valor em uma coluna escolhida são combinados em um registro, independentemente de quão distantes foram enviados. Ele é adequado para um lote em que arquivos de documentos diferentes estão misturados — por exemplo, documentos alfandegários de vários pedidos fotografados em nenhuma ordem específica, onde o número do pedido é o valor que identifica quais arquivos pertencem juntos.
Como ele compara cada resultado com todos os outros, este modo exige que a coluna escolhida esteja presente e seja lida corretamente em todos os arquivos que devem ser agrupados. Se o valor de um arquivo para essa coluna vier vazio, esse arquivo é deixado como seu próprio registro em vez de ser correspondido a um grupo.
Fixed Count
Este modo ignora o conteúdo inteiramente: a cada N arquivos em sequência, eles se tornam um registro. Informe o tamanho do grupo (N) e o aplicativo combina arquivos em blocos fixos. Ele é destinado a um registro que é sempre composto pelo mesmo número de itens diferentes — por exemplo, um registro de despesa que sempre consiste em uma foto do recibo, um print do pagamento bancário e um e-mail de aprovação, três arquivos por registro.
Quando vários arquivos discordam sobre um valor
Depois que as linhas são agrupadas, o aplicativo as combina campo por campo. Uma coluna cujos arquivos concordam — ou onde apenas um arquivo tem um valor — é tratada como um valor compartilhado e preenchida em cada linha do registro. É isso que permite, por exemplo, que um número de conta que aparece apenas na página 1 seja copiado para cada linha de transação das páginas posteriores.
Se uma coluna tiver dois ou mais valores não vazios diferentes dentro de um grupo, isso é um conflito, e você escolhe como ele é resolvido. A escolha se aplica ao modelo inteiro, não a colunas individuais.
| Opção de conflito | O que acontece com a coluna em conflito |
|---|---|
| Combine into one (padrão) | Todos os valores diferentes são unidos em uma única célula. O separador padrão é uma barra com espaços (/), e você pode alterá-lo em Join Values With — incluindo limpá-lo para unir valores sem nada entre eles. |
| Keep all, split into rows | Nada é adivinhado. Em vez de uma linha mesclada, você obtém uma linha por arquivo, para que possa verificar cada valor você mesmo. Os valores em que os arquivos concordam ainda são preenchidos. |
| Keep the first value | O valor do arquivo enviado primeiro vence; os outros são descartados. |
| Keep the last value | O valor do arquivo enviado por último vence; os outros são descartados. |
Apenas as colunas que realmente entram em conflito são afetadas. As colunas em que os arquivos concordam, e as colunas que apenas um arquivo preencheu, ainda são compartilhadas em todo o registro.
Onde ativar
Multi-Page Merge é uma configuração dentro de um modelo, ao lado das outras opções do modelo.
- Abra o painel Data Columns no painel e clique em Settings no cabeçalho do modelo. (A mesma ação Settings aparece em cada linha no diálogo Switch Template.)
- No diálogo Template Settings, encontre a linha Merge Multiple Results e ative-a.
- Escolha um modo de mesclagem em How to merge. Se você escolheu Sequential Merge, também escolha uma condição de quebra em Where to break e, quando solicitado, a Data Column, o valor ou o tamanho do grupo que o modo precisa.
- Escolha uma opção em Merge Conflict Handling.
O diálogo mostra um resumo em linguagem simples das suas escolhas atuais, além de um exemplo prático, para que você possa ler de volta o que a configuração fará antes de confiar nela. As alterações são salvas automaticamente — não há botão de salvar separado, e fechar o diálogo mantém as alterações. Se uma coluna, valor ou tamanho de grupo obrigatório ainda não foi preenchido, o diálogo mostra um aviso de que a configuração não terá efeito até que seja; o aplicativo não gera erro em uma configuração de mesclagem incompleta, simplesmente deixa os resultados sem mesclar.
Como isso está nas configurações do modelo, é o mesmo diálogo descrito na página Templates & Columns. Uma configuração de mesclagem sempre pertence a um modelo; um lote processado sem modelo não tem configuração de modelo para armazená-la.
Onde a mesclagem tem efeito
Multi-Page Merge não altera como os arquivos são processados. Ele altera a tabela produzida na exportação. Funciona dentro de um único lote e nunca combina linhas entre lotes diferentes — veja Batches para entender o que é um lote e como os arquivos são agrupados em um.
- A visualização dos resultados no aplicativo é por arquivo. Ao abrir um arquivo para inspecionar suas linhas extraídas, você vê os resultados desse arquivo. As linhas não são combinadas nesta visualização.
- A exportação de um lote aplica a mesclagem automaticamente. Se o modelo do lote tiver a mesclagem ativada, a planilha exportada é mesclada. Não há um botão separado de "mesclar esta exportação" para ativar no momento da exportação.
- A exportação de vários lotes juntos também aplica a mesclagem, usando as configurações de modelo de cada lote, antes de os lotes serem alinhados em um único arquivo.
- A mesclagem é aplicada apenas quando o lote foi processado com um modelo que tem a mesclagem ativada. A configuração é lida do modelo na exportação, então, se você corrigir uma configuração de mesclagem após o processamento, a próxima exportação desse lote usará a configuração corrigida.
A mesma configuração também rege os resultados enviados ao complemento do Google Sheets: quando o modelo de um lote tem a mesclagem ativada, as linhas gravadas na planilha são as combinadas.
A confirmação antes da exportação
Por padrão, exportar um único lote com a mesclagem ativada abre primeiro uma tela de Confirm Merge Before Export. Ela mostra duas tabelas lado a lado — Before merge (raw results) e After merge (export result) — com linhas do mesmo grupo de mesclagem compartilhando uma cor, para que você possa ver quais linhas brutas produziram qual linha combinada. Você pode editar um valor bruto aqui, ajustar as configurações de mesclagem diretamente na mesma tela e então clicar em Confirm & Export para gerar o arquivo.
Se você não quiser essa confirmação toda vez, ative Skip confirmation before export nas configurações do modelo. Exportar vários lotes juntos não mostra essa tela de confirmação; ele aplica a mesclagem e gera o arquivo diretamente.