Lorsque votre seule copie de CV est une image scannée ou une photo de téléphone plutôt qu'un fichier texte, CVBuilderKit la lit quand même, mais ce qui se passe ensuite dépend de laquelle des deux vous avez réellement. Un PDF scanné ou photographié voit sa couche de texte lue de la même façon que n'importe quel PDF, jusqu'à ses quatre premières pages, et chacune de ces pages est aussi rendue en image en plus de tout texte trouvé, car une page sans véritable couche de texte en dessous serait sinon importée vide. Une simple photo d'une page, enregistrée directement en fichier PNG, JPEG ou WEBP plutôt qu'emballée dans un PDF, saute entièrement l'étape de lecture du texte et est envoyée comme une seule image. Dans les deux cas, obtenir un résultat exploitable commence par la qualité de l'image source, pas par quoi que ce soit que l'étape d'import puisse corriger ensuite.
En quoi un PDF scanné diffère d'une image photographiée
Un PDF scanné, produit par une application de numérisation ou un scanner de documents, peut porter ou non une véritable couche de texte sous l'image de la page, selon que l'application qui l'a créé a effectué ou non sa propre reconnaissance de texte. L'import de CVBuilderKit n'a pas besoin que cette couche de texte existe : il tente toujours de lire le texte des quatre premières pages de n'importe quel PDF, et rend toujours ces mêmes pages en images aussi, si bien qu'un PDF scanné sans texte exploitable en dessous arrive quand même sous forme d'un ensemble d'images de pages que l'étape d'extraction peut lire visuellement. Un simple fichier photo téléversé seul fonctionne différemment. N'ayant aucune structure de page dont extraire du texte au départ, il est envoyé purement comme une image, sans qu'aucune étape de lecture de texte ne soit tentée. La différence pratique est le nombre de pages : un PDF peut porter plusieurs pages d'un document scanné à la fois, alors qu'un fichier photo autonome ne représente jamais que la seule page dont il est la photo.
Obtenir une source lisible avant de téléverser
Une photo plate, uniformément éclairée et cadrée d'une page donne systématiquement un résultat plus propre qu'une photo prise à la hâte. Aplatir une page plutôt que la photographier avec une courbure ou un pli évite d'introduire une déformation du texte qu'un scan droit n'a jamais. Un éclairage uniforme et diffus plutôt qu'un flash direct évite les reflets sur du papier brillant, car un reflet lumineux situé directement sur une ligne de texte peut réellement rendre cette ligne illisible dans l'image résultante. Recadrer la photo à peu près sur les bords de la page elle-même, plutôt que d'inclure une large marge de bureau ou d'arrière-plan, garde le texte réel aussi grand et détaillé que possible dans la résolution que le navigateur finit par envoyer, puisqu'une photo est automatiquement redimensionnée avant d'être envoyée et qu'une page bien cadrée conserve davantage de cette résolution au service du texte lui-même. Une page par image vaut aussi la peine d'être respectée, plutôt que d'essayer de faire tenir deux pages côte à côte dans une seule photo, car le texte de chaque page finit par être plus petit et plus difficile à lire une fois que deux pages partagent le même cadre.
Un fichier à la fois : regrouper plusieurs pages en un seul PDF
Le téléversement ne prend jamais qu'un seul fichier à la fois, si bien qu'une photo téléversée seule ne contribue que la seule page qu'elle montre, rien de plus. Si un CV s'étend sur plus d'une page photographiée, la voie pratique consiste à regrouper ces photos séparées en un seul PDF multipage avant de téléverser, en utilisant la propre fonction de numérisation de documents du téléphone ou une application de numérisation similaire, plutôt que d'essayer de téléverser les pages une par une. Un PDF regroupé est ensuite lu jusqu'à ses quatre premières pages ensemble, texte et images à la fois, en un seul import, alors qu'une série de téléversements de photos séparées ne ferait à chaque fois que remplacer celle déjà présente sur la page plutôt que de s'additionner en un document multipage.
Ce qu'il faut encore vérifier après un import basé sur l'image
Comme il n'y avait aucun texte sous-jacent à extraire pour une image pure ou une page scannée sans texte, chaque ligne que l'étape d'extraction renvoie pour ce type de source provient de la lecture de l'image elle-même plutôt que de la copie d'un texte numérique fiable, si bien qu'une relecture attentive ensuite compte encore plus ici que pour un PDF basé sur du texte, un point de départ traité plus en détail dans reconstruire un CV PDF en document modifiable. Les nombres et les dates méritent un second regard spécifique. Un chiffre lu comme un autre chiffre à partir d'une photo légèrement floue ou mal éclairée est exactement le genre de petite erreur facile à introduire à ce stade et facile à manquer de nouveau lors d'une relecture rapide ensuite.
Exemple illustratif : un champ qui nécessite une vérification manuelle après un import d'image
Exemple illustratif. Une page de CV photographiée montre un numéro de téléphone composé dans une police légèrement floue et peu contrastée dans l'en-tête, à côté d'une petite icône plutôt que d'un libellé textuel. Après un import basé sur l'image, tout le reste sur cette page, les intitulés de poste, les puces, les dates placées plus bas sur la page dans une police plus claire et plus contrastée, se lit correctement, mais le numéro de téléphone arrive avec un chiffre transposé, car une photo floue laisse moins de matière à une lecture attentive que le texte imprimé net partout ailleurs sur la même page. Ce seul champ est exactement le genre de détail qui mérite une vérification spécifique avant d'envoyer le CV où que ce soit, plutôt que de supposer que la lecture de tout le document s'est déroulée aussi proprement que les parties les plus faciles à bien photographier.
Commencer la reconstruction
Un CV scanné ou photographié n'a pas besoin de rester une impasse simplement parce que la source n'est pas du texte. Prenez une photo plate, bien éclairée et cadrée de chaque page, regroupez plusieurs pages en un seul PDF d'abord si vous en avez, et commencez la reconstruction. Pour une source déjà en PDF basé sur du texte, reconstruire un CV PDF en document modifiable traite le parcours équivalent pour ce point de départ, et comment rédiger un CV traite la structure qui mérite d'être vérifiée une fois le contenu lui-même passé.
