A digitalização de documentos em massa produz um único PDF enorme contendo centenas de documentos individuais, cada um separado do seguinte por nada mais do que uma página de código de barras. O código de barras, normalmente um símbolo do Código 39 ou do Código 128 impresso em uma folha em branco, atua como uma divisória legível por máquina que informa aos sistemas automatizados onde um documento termina e o próximo começa. Dividir um PDF detectando essas páginas separadoras de código de barras requer uma ferramenta Split PDF com capacidade de reconhecimento de código de barras, que lê cada página, identifica quais páginas contêm códigos de barras e usa essas páginas como pontos de divisão para separar o documento em seus arquivos constituintes.

Como funcionam as páginas separadoras de código de barras na digitalização de documentos
Antes de um grande lote de documentos em papel ser digitalizado, uma folha separadora de código de barras é colocada em cima de cada documento individual na pilha. O scanner alimenta toda a pilha como um único trabalho contínuo, produzindo um PDF que pode ter milhares de páginas. As folhas de código de barras são distribuídas por todo o PDF na fronteira entre cada par de documentos originais. Cada código de barras codifica informações que identificam o que vem depois dele: um código de tipo de documento, um número de caso, um ID de funcionário ou uma referência de arquivo.
O código de barras não precisa ser visualmente significativo para os humanos. É um suporte de dados legível por máquina, impresso em um padrão de barras verticais de larguras variadas. A ferramenta de processamento PDF Batch lê o valor do código de barras e o utiliza para determinar o ponto de divisão e, opcionalmente, o nome do arquivo do documento extraído. Um código de barras de página separadora que codifica o valor INV-2026-0047 informa ao divisor para iniciar um novo documento nesta página e nomear o arquivo de saída INV-2026-0047.pdf.
Experimente dividir PDF
Nenhuma instalação necessária. Funciona diretamente no seu navegador.
Preparando o PDF para divisão baseada em código de barras
Antes de executar a divisão, verifique se cada página separadora no PDF contém um código de barras claramente impresso e sem danos. Um código de barras manchado, parcialmente obscurecido por um furo de grampo ou impresso em ângulo pode não ser reconhecido corretamente, fazendo com que o divisor perca o ponto de divisão ou leia um valor incorreto. Percorra o PDF rapidamente e verifique uma amostra aleatória de páginas separadoras. O código de barras deve ser impresso em tinta preta escura em papel branco limpo, com pelo menos um quarto de polegada de espaço em branco em todos os lados.
Confirme se as páginas do código de barras são a primeira página de cada documento e não a última página do documento anterior. Esta convenção é quase universal na digitalização de documentos porque significa que o valor do código de barras descreve o documento a seguir. Se as páginas de código de barras do seu PDF foram colocadas como a última página de cada documento, a maioria das ferramentas de divisão de código de barras tem uma configuração para ajustar isso, mas a suposição padrão é que o código de barras esteja na primeira página de cada novo documento.
Selecionando uma ferramenta que suporte reconhecimento de código de barras
Os divisores de PDF padrão que dividem por contagem de páginas ou por marcador não conseguem detectar códigos de barras, porque o reconhecimento do código de barras requer análise óptica da imagem da página. Procure uma ferramenta de captura de documentos ou gerenciamento de conteúdo empresarial que liste explicitamente a separação baseada em código de barras como um recurso. Adobe Acrobat Pro inclui reconhecimento de código de barras em seu Action Wizard para processamento de documentos. Plataformas Split PDF baseadas em navegador com detecção de código de barras lidam com o reconhecimento do lado do servidor e retornam os arquivos divididos como um arquivo para download.
Para organizações que processam PDFs separados por código de barras regularmente, softwares dedicados de captura de documentos, como Kofax, Ephesoft ou Abbyy FlexiCapture, fornecem o reconhecimento de código de barras mais confiável. Essas ferramentas são projetadas especificamente para separação de documentos de alto volume e incluem recursos como regras de validação de códigos de barras, tratamento de exceções para códigos de barras ilegíveis e integração com sistemas de gerenciamento de documentos. WukongPDF e plataformas semelhantes fornecem divisão baseada em navegador que pode ser acessada sem instalação de software empresarial.
Definir configurações de reconhecimento de código de barras
A maioria das ferramentas de divisão de código de barras exige que você especifique o tipo de código de barras antes do processamento. Os dois tipos mais comuns de digitalização de documentos são o Código 39, que codifica caracteres alfanuméricos e é amplamente utilizado em registros legais e médicos, e o Código 128, que codifica o conjunto completo de caracteres ASCII e produz códigos de barras mais compactos para os mesmos dados. Selecione o tipo de código de barras correto nas configurações da ferramenta. Selecionar o tipo errado faz com que todos os códigos de barras não sejam reconhecidos e a ferramenta informará que nenhum ponto de divisão foi encontrado.
Algumas ferramentas oferecem uma configuração de orientação de código de barras. Os códigos de barras nas páginas separadoras normalmente são impressos horizontalmente, mas se as páginas foram alimentadas pelo scanner na orientação paisagem ou se o código de barras foi impresso verticalmente ao longo da borda da página, o mecanismo de reconhecimento precisa saber qual orientação digitalizar. Defina a orientação como Automática, se disponível, o que informa ao mecanismo para verificar todas as quatro rotações possíveis para cada página.
Nomeando os arquivos de saída usando valores de código de barras
O valor do código de barras em cada página separadora pode servir como acionador de divisão e como nome do arquivo de saída. Configure a ferramenta de divisão para usar o valor do código de barras como nome de arquivo do documento que segue o separador. Um separador com valor de código de barras CASE-0042-HARRIS produz um arquivo de saída denominado CASE-0042-HARRIS.pdf contendo todas as páginas desse separador até, mas não incluindo, a próxima página do separador.
Se os valores do código de barras não seguirem um formato seguro para nomeação de arquivos, como espaços, caracteres especiais ou caracteres ilegais em nomes de arquivos, configure a ferramenta para limpar os valores. A maioria das ferramentas substitui automaticamente os espaços por sublinhados ou hífens e remove caracteres que os sistemas de arquivos Windows ou macOS não permitem. Verifique os nomes dos arquivos de saída após o primeiro trabalho dividido para confirmar se a higienização produziu nomes úteis e legíveis, em vez de sequências de caracteres removidos que não transmitem mais o significado original.
Tratamento de códigos de barras ilegíveis e ausentes
Nenhum processo de reconhecimento de código de barras é perfeito. Códigos de barras borrados, páginas alimentadas distorcidas e folhas separadoras que foram omitidas acidentalmente durante a digitalização produzem erros de divisão. Configure a ferramenta de tratamento de exceções para sinalizar páginas não reconhecidas em vez de mesclar silenciosamente os documentos em ambos os lados de um ponto de divisão perdido. A ferramenta deve gerar um relatório de exceção listando todas as páginas onde um código de barras era esperado, mas não foi encontrado, juntamente com o número da página e, se possível, uma miniatura da imagem da página.
Após a conclusão da divisão automatizada, revise o relatório de exceção e divida manualmente todos os documentos que a ferramenta não conseguiu separar automaticamente. Abra o PDF original, navegue até os números de página sinalizados, determine onde a divisão deve ocorrer e extraia as páginas manualmente usando uma ferramenta de extração de páginas PDF. A etapa de tratamento manual de exceções leva minutos para algumas divisões perdidas, em comparação com horas de divisão manual para cada documento do lote.
Para projetos futuros de digitalização, melhore a legibilidade do código de barras usando impressão de código de barras com maior contraste, colocando os códigos de barras longe das bordas das páginas, onde as sombras do scanner podem obscurecê-los, e executando uma verificação de qualidade pré-digitalização nas páginas separadoras antes de serem inseridas na pilha de documentos.
Validação dos resultados da divisão em relação ao inventário do documento original
Após a conclusão da divisão automática do código de barras, compare o número de arquivos de saída com a contagem esperada de documentos. Se o projeto de digitalização original registrou 247 documentos sendo digitalizados, a divisão deverá produzir exatamente 247 arquivos de saída. Uma incompatibilidade indica pontos de divisão perdidos, onde dois documentos foram mesclados em um arquivo de saída, ou pontos de divisão falsos, onde um único documento foi dividido porque algo em uma de suas páginas foi confundido com um código de barras.
Para projetos de divisão de alto risco, como descoberta legal ou migração de registros médicos, execute uma reconciliação de contagem de páginas. A contagem total de páginas em todos os arquivos de saída deve ser igual à contagem de páginas do PDF original menos as páginas separadoras. Uma discrepância de pelo menos uma página significa que a divisão não foi perfeita e requer revisão manual da saída.
Salve as páginas separadoras como um PDF separado em vez de descartá-las. Os valores do código de barras nessas páginas fornecem a trilha de auditoria que conecta cada arquivo de saída à sua posição original no lote digitalizado. Se surgir uma dúvida sobre um documento específico meses depois, o arquivo de páginas separadoras confirma exatamente de onde veio esse documento.
Para operações de divisão PDF Lote executadas de acordo com uma programação, como o processamento noturno de documentos digitalizados em uma impressora multifuncional, automatize todo o fluxo de trabalho, desde a digitalização até a divisão e o arquivamento. Uma pasta monitorada monitora novos PDFs. Quando um PDF chega, o divisor de código de barras o processa automaticamente e deposita os arquivos divididos em pastas categorizadas com base nos valores do código de barras. A automação transforma uma tarefa de divisão manual em um processo em segundo plano que não requer atenção humana.
Ao selecionar um tipo de código de barras para um novo projeto de digitalização de documentos, escolha Código 128 em vez de Código 39 se os valores do código de barras contiverem letras e números. O Code 128 produz códigos de barras mais compactos para dados alfanuméricos, o que significa que o símbolo do código de barras pode ser impresso em tamanho menor na página separadora sem perder a capacidade de leitura.
Para projetos PDF Batch de longo prazo, documente as especificações do código de barras e a configuração de divisão em um arquivo de projeto armazenado junto com os documentos digitalizados. Quando o projeto é revisitado meses ou anos depois, a documentação responde às perguntas sobre qual tipo de código de barras foi usado, o que os valores do código de barras representam e como a divisão foi configurada.
Ao substituir o PDF Batch baseado em código de barras, a divisão pela separação manual é necessária devido a problemas de qualidade do código de barras, o tempo necessário aumenta drasticamente. Um lote que se divide automaticamente em minutos pode levar horas para ser separado manualmente.
Experimente dividir PDF
Nenhuma instalação necessária. Funciona diretamente no seu navegador.
