La numérisation de documents en masse produit un seul PDF massif contenant des centaines de documents individuels, chacun séparé du suivant par rien de plus qu'une page de code-barres. Le code-barres, généralement un symbole Code 39 ou Code 128 imprimé sur une feuille vierge, agit comme un séparateur lisible par machine qui indique aux systèmes automatisés où se termine un document et où commence le suivant. La division d'un PDF en détectant ces pages de séparation de codes-barres nécessite un outil Split PDF doté d'une capacité de reconnaissance de codes-barres, qui lit chaque page, identifie les pages contenant des codes-barres et utilise ces pages comme points de partage pour séparer le document en ses fichiers constitutifs.

Comment fonctionnent les pages de séparation de codes-barres dans la numérisation de documents
Avant de numériser un grand lot de documents papier, une feuille de séparation de codes-barres est placée au-dessus de chaque document individuel de la pile. Le scanner alimente la pile entière en une seule tâche continue, produisant un PDF pouvant contenir des milliers de pages. Les feuilles de codes-barres sont réparties dans tout le PDF à la limite entre chaque paire de documents originaux. Chaque code-barres code des informations qui identifient ce qui vient après : un code de type de document, un numéro de dossier, un identifiant d'employé ou une référence de fichier.
Le code-barres n’a pas besoin d’être visuellement significatif pour les humains. Il s’agit d’un support de données lisible par machine imprimé selon un motif de barres verticales de différentes largeurs. L'outil de traitement PDF Batch lit la valeur du code-barres et l'utilise pour déterminer à la fois le point de partage et, éventuellement, le nom de fichier du document extrait. Un code-barres de page de séparation codant la valeur INV-2026-0047 indique au séparateur de commencer un nouveau document à cette page et de nommer le fichier de sortie INV-2026-0047.pdf.
Essayez de diviser le PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
Préparation du PDF pour le fractionnement basé sur un code-barres
Avant d'exécuter le fractionnement, vérifiez que chaque page de séparation du PDF contient un code-barres clairement imprimé et intact. Un code-barres taché, partiellement masqué par un trou d'agrafe ou imprimé sous un angle peut ne pas être reconnu correctement, ce qui fait que le séparateur manque le point de division ou lit une valeur incorrecte. Faites défiler rapidement le PDF et vérifiez un échantillon aléatoire de pages de séparation. Le code-barres doit être imprimé à l’encre noire foncée sur du papier blanc propre, avec au moins un quart de pouce d’espace blanc de tous les côtés.
Confirmez que les pages de codes-barres sont la première page de chaque document et non la dernière page du document précédent. Cette convention est presque universelle dans la numérisation de documents car elle signifie que la valeur du code-barres décrit le document qui suit. Si les pages de codes-barres de votre PDF ont été placées comme dernière page de chaque document, la plupart des outils de fractionnement de codes-barres ont un paramètre pour ajuster cela, mais l'hypothèse par défaut est que le code-barres se trouve sur la première page de chaque nouveau document.
Sélection d'un outil prenant en charge la reconnaissance des codes-barres
Les séparateurs PDF standard qui divisent par nombre de pages ou par signet ne peuvent pas détecter les codes-barres, car la reconnaissance des codes-barres nécessite une analyse optique de l'image de la page. Recherchez un outil de capture de documents ou de gestion de contenu d'entreprise qui répertorie explicitement la séparation basée sur les codes-barres comme fonctionnalité. Adobe Acrobat Pro inclut la reconnaissance de codes-barres dans son assistant d'action pour le traitement des documents. Les plates-formes Split PDF basées sur un navigateur avec détection de codes-barres gèrent la reconnaissance côté serveur et renvoient les fichiers fractionnés sous forme d'archive téléchargeable.
Pour les organisations qui traitent régulièrement des PDF séparés par codes-barres, les logiciels de capture de documents dédiés tels que Kofax, Ephesoft ou Abbyy FlexiCapture offrent la reconnaissance de codes-barres la plus fiable. Ces outils sont conçus spécifiquement pour la séparation de documents volumineux et incluent des fonctionnalités telles que des règles de validation de codes-barres, la gestion des exceptions pour les codes-barres illisibles et l'intégration avec les systèmes de gestion de documents. Le WukongPDF et les plates-formes similaires permettent un fractionnement basé sur un navigateur accessible sans installation de logiciel d'entreprise.
Configuration des paramètres de reconnaissance de codes-barres
La plupart des outils de fractionnement de codes-barres nécessitent que vous spécifiiez le type de code-barres avant le traitement. Les deux types les plus courants dans la numérisation de documents sont le code 39, qui code les caractères alphanumériques et est largement utilisé dans les dossiers juridiques et médicaux, et le code 128, qui code le jeu de caractères ASCII complet et produit des codes-barres plus compacts pour les mêmes données. Sélectionnez le type de code-barres correct dans les paramètres de l'outil. Si vous sélectionnez le mauvais type, tous les codes-barres ne seront pas reconnus et l'outil signalera qu'aucun point de partage n'a été trouvé.
Certains outils proposent un paramètre d’orientation du code-barres. Les codes-barres sur les pages de séparation sont généralement imprimés horizontalement, mais si les pages ont été introduites dans le scanner en orientation paysage ou si le code-barres a été imprimé verticalement le long du bord de la page, le moteur de reconnaissance doit savoir dans quelle orientation numériser. Définissez l'orientation sur Auto si disponible, ce qui indique au moteur de vérifier les quatre rotations possibles pour chaque page.
Nommer les fichiers de sortie à l'aide de valeurs de code-barres
La valeur du code-barres sur chaque page de séparation peut servir à la fois de déclencheur de fractionnement et de nom de fichier de sortie. Configurez l'outil de fractionnement pour utiliser la valeur du code-barres comme nom de fichier pour le document qui suit le séparateur. Un séparateur avec la valeur de code-barres CASE-0042-HARRIS produit un fichier de sortie nommé CASE-0042-HARRIS.pdf contenant toutes les pages de ce séparateur jusqu'à la page de séparateur suivante, mais sans l'inclure.
Si les valeurs du code-barres ne suivent pas un format sécurisé pour la dénomination des fichiers, par exemple contenant des espaces, des caractères spéciaux ou des caractères illégaux dans les noms de fichiers, configurez l'outil pour nettoyer les valeurs. La plupart des outils remplacent automatiquement les espaces par des traits de soulignement ou des traits d'union et suppriment les caractères que les systèmes de fichiers Windows ou macOS n'autorisent pas. Vérifiez les noms des fichiers de sortie après la première tâche fractionnée pour confirmer que la désinfection a produit des noms lisibles et utiles plutôt que des chaînes de caractères supprimés qui ne véhiculent plus la signification originale.
Gestion des codes-barres illisibles et manquants
Aucun processus de reconnaissance de codes-barres n’est parfait. Les codes-barres tachés, les pages alimentées de travers et les feuilles de séparation accidentellement omises lors de la numérisation produisent tous des erreurs de fractionnement. Configurez la gestion des exceptions de l'outil pour signaler les pages non reconnues plutôt que de fusionner silencieusement les documents de chaque côté d'un point de partage manqué. L'outil doit générer un rapport d'exception répertoriant chaque page sur laquelle un code-barres était attendu mais introuvable, ainsi que le numéro de page et, si possible, une vignette de l'image de la page.
Une fois la division automatisée terminée, examinez le rapport d'exception et divisez manuellement tous les documents que l'outil n'a pas pu séparer automatiquement. Ouvrez le PDF d'origine, accédez aux numéros de page signalés, déterminez où la division doit se produire et extrayez les pages manuellement à l'aide d'un outil d'extraction de pages PDF. L'étape de gestion manuelle des exceptions prend quelques minutes pour une poignée de fractionnements manqués, contre des heures de fractionnement manuel pour chaque document du lot.
Pour les futurs projets de numérisation, améliorez la lisibilité des codes-barres en utilisant une impression de codes-barres à contraste plus élevé, en plaçant les codes-barres à l'écart des bords des pages où les ombres du scanner peuvent les obscurcir et en effectuant un contrôle de qualité avant la numérisation sur les pages de séparation avant qu'elles ne soient insérées dans la pile de documents.
Validation des résultats fractionnés par rapport à l'inventaire des documents d'origine
Une fois la division automatisée des codes-barres terminée, comparez le nombre de fichiers de sortie au nombre de documents attendu. Si le projet de numérisation d'origine a enregistré 247 documents numérisés, la division devrait produire exactement 247 fichiers de sortie. Une incohérence indique soit des points de partage manqués, où deux documents ont été fusionnés en un seul fichier de sortie, soit de faux points de partage, où un seul document a été divisé parce qu'un élément de l'une de ses pages a été confondu avec un code-barres.
Pour les projets de fractionnement à enjeux élevés tels que la découverte juridique ou la migration de dossiers médicaux, effectuez un rapprochement du nombre de pages. Le nombre total de pages dans tous les fichiers de sortie doit être égal au nombre de pages du PDF original moins les pages de séparation. Un écart ne serait-ce qu'une seule page signifie que la répartition n'était pas parfaite et nécessite un examen manuel du résultat.
Enregistrez les pages de séparation dans un PDF distinct plutôt que de les supprimer. Les valeurs des codes-barres sur ces pages fournissent la piste d'audit qui relie chaque fichier de sortie à sa position d'origine dans le lot numérisé. Si une question se pose sur un document spécifique des mois plus tard, les archives des pages de séparation confirment exactement la provenance de ce document.
Pour les opérations de fractionnement PDF Batch qui s'exécutent selon un planning, telles que le traitement nocturne des documents numérisés à partir d'une imprimante multifonction, automatisez l'ensemble du flux de travail, de la numérisation à la division en passant par l'archivage. Un dossier surveillé surveille les nouveaux PDF. Lorsqu'un PDF arrive, le séparateur de codes-barres le traite automatiquement et dépose les fichiers fractionnés dans des dossiers catégorisés en fonction des valeurs du code-barres. L'automatisation transforme une tâche de fractionnement manuelle en un processus d'arrière-plan qui ne nécessite aucune attention humaine.
Lors de la sélection d'un type de code-barres pour un nouveau projet de numérisation de documents, choisissez le code 128 plutôt que le code 39 si les valeurs du code-barres contiennent à la fois des lettres et des chiffres. Le Code 128 produit des codes-barres plus compacts pour les données alphanumériques, ce qui signifie que le symbole du code-barres peut être imprimé plus petit sur la page de séparation sans perdre en capacité de lecture.
Pour les projets PDF Batch à long terme, documentez les spécifications du code-barres et la configuration de fractionnement dans un fichier de projet stocké avec les documents numérisés. Lorsque le projet est revisité des mois ou des années plus tard, la documentation répond aux questions sur le type de code-barres utilisé, ce que représentent les valeurs du code-barres et comment la répartition a été configurée.
Lorsque le remplacement du fractionnement PDF Batch basé sur les codes-barres par une séparation manuelle est nécessaire en raison de problèmes de qualité des codes-barres, le temps requis augmente considérablement. Un lot qui se divise automatiquement en quelques minutes peut prendre des heures pour être séparé manuellement.
Essayez de diviser le PDF
Aucune installation nécessaire. Fonctionne directement dans votre navigateur.
