Als je enige cv-kopie een gescande afbeelding of een telefoonfoto is in plaats van een tekstbestand, leest CVBuilderKit die toch, maar wat er daarna gebeurt hangt af van welke van de twee je eigenlijk hebt. Een gescand of gefotografeerd PDF-bestand krijgt zijn tekstlaag gelezen zoals elk PDF-bestand, tot de eerste vier pagina's, en elk van die pagina's wordt ook als afbeelding weergegeven naast eventuele gevonden tekst, omdat een pagina zonder echte tekstlaag eronder anders leeg zou worden geïmporteerd. Eén enkele foto van een pagina, direct opgeslagen als PNG-, JPEG- of WEBP-bestand in plaats van verpakt in een PDF, slaat de tekstleesstap volledig over en wordt als één losse afbeelding verstuurd. Hoe dan ook, een bruikbaar resultaat krijgen begint bij de kwaliteit van de bronafbeelding, niet bij iets wat de importstap achteraf kan repareren.
Hoe een gescand PDF verschilt van een gefotografeerde afbeelding
Een gescand PDF, gemaakt door een scan-app of een documentscanner, heeft mogelijk wel of geen echte tekstlaag onder de pagina-afbeelding, afhankelijk van of de app die het maakte zelf tekstherkenning heeft uitgevoerd. De import van CVBuilderKit heeft die tekstlaag niet nodig om te bestaan: het probeert altijd tekst te lezen uit de eerste vier pagina's van elk PDF-bestand, en het geeft die pagina's ook altijd als afbeeldingen weer, dus een gescand PDF zonder bruikbare tekst eronder komt alsnog binnen als een set paginabeelden die de extractiestap visueel kan lezen. Een los foto-bestand dat op zichzelf wordt geüpload werkt anders. Omdat het van meet af aan geen paginastructuur heeft om tekst uit te lezen, wordt het puur als afbeelding verstuurd, zonder dat er ook maar een tekstleesstap wordt geprobeerd. Het praktische verschil is het aantal pagina's: een PDF kan meerdere pagina's van een gescand document tegelijk dragen, terwijl een losstaand foto-bestand altijd alleen de ene pagina vertegenwoordigt waarvan het een foto is.
Zorg voor een leesbare bron voordat je uploadt
Een platte, gelijkmatig verlichte, uitgesneden foto van een pagina geeft consequent een schoner resultaat dan een haastig genomen foto. Een pagina plat leggen in plaats van te fotograferen met een kromming of vouw voorkomt een vervorming over de tekst die een rechte scan nooit heeft. Gelijkmatig, diffuus licht in plaats van directe flits houdt glans weg van glanzend papier, want een felle weerkaatsing recht boven een regel tekst kan die regel in de resulterende afbeelding daadwerkelijk onleesbaar maken. Door de foto ongeveer tot de randen van de pagina zelf bij te snijden, in plaats van een brede rand bureau of achtergrond eromheen mee te nemen, blijft de eigenlijke tekst zo groot en gedetailleerd mogelijk binnen de resolutie die de browser uiteindelijk verstuurt, aangezien een foto automatisch verkleind wordt voordat hij wordt verstuurd en een strak bijgesneden pagina meer van die resolutie overhoudt voor de tekst zelf. Eén pagina per afbeelding is ook de moeite waard om aan te houden, in plaats van te proberen twee pagina's naast elkaar in één foto te persen, want de tekst op elke afzonderlijke pagina wordt kleiner en moeilijker leesbaar zodra twee pagina's hetzelfde kader delen.
Eén bestand tegelijk: meerdere pagina's samenvoegen tot één PDF
Het uploaden accepteert altijd maar één bestand tegelijk, dus een foto die alleen wordt geüpload levert alleen de ene pagina die hij toont, niets meer. Als een cv over meer dan één gefotografeerde pagina loopt, is de praktische route om die losse foto's eerst samen te voegen tot één meerpagina-PDF voordat je uploadt, met de eigen documentscanfunctie van de telefoon of een vergelijkbare scan-app, in plaats van te proberen de pagina's één voor één te uploaden. Een samengevoegd PDF wordt vervolgens tot de eerste vier pagina's samen gelezen, tekst en afbeeldingen tegelijk, in één import, terwijl een reeks losse foto-uploads elke keer alleen de foto die al op de pagina staat zou vervangen, in plaats van op te tellen tot een meerpaginadocument.
Wat na een op afbeeldingen gebaseerde import nog gecontroleerd moet worden
Omdat er bij een pure afbeelding of een tekstvrije gescande pagina geen onderliggende tekst was om te extraheren, komt elke regel die de extractiestap voor dat type bron teruggeeft voort uit het lezen van de afbeelding zelf in plaats van het kopiëren van betrouwbare digitale tekst, dus een zorgvuldige doorlezing achteraf telt hier nog zwaarder dan bij een op tekst gebaseerd PDF, een startpunt dat uitgebreider behandeld wordt in een PDF-cv herbouwen tot een bewerkbaar document. Cijfers en data verdienen een specifieke tweede blik. Een cijfer dat vanuit een licht wazige of slecht verlichte foto als een ander cijfer wordt gelezen, is precies het soort kleine fout die in deze fase makkelijk ontstaat en achteraf bij een snelle doorloop opnieuw makkelijk over het hoofd wordt gezien.
Illustratief voorbeeld: een veld dat na een afbeeldingsimport handmatige controle nodig heeft
Illustratief voorbeeld. Een gefotografeerde cv-pagina toont een telefoonnummer gezet in een licht wazig, contrastarm lettertype in de koptekst, naast een klein pictogram in plaats van een tekstlabel. Na een op afbeeldingen gebaseerde import leest al het andere op die pagina, de functietitels, de bullets, de data verderop op de pagina in een helderder, contrastrijker lettertype, correct, maar het telefoonnummer komt binnen met één omgewisseld cijfer, omdat een wazige foto zelfs een zorgvuldige lezing minder te bieden heeft dan de scherpe gedrukte tekst overal elders op diezelfde pagina. Dat ene veld is precies het soort detail dat een specifieke controle waard is voordat je het cv ergens naartoe stuurt, in plaats van aan te nemen dat het lezen van het hele document even schoon verliep als de onderdelen die het makkelijkst goed te fotograferen waren.
Begin de heropbouw
Een gescand of gefotografeerd cv hoeft geen doodlopende weg te blijven alleen omdat de bron geen tekst is. Maak een platte, goed verlichte, bijgesneden foto van elke pagina, voeg meer dan één pagina eerst samen tot één PDF als je die hebt, en begin de heropbouw. Voor een bron die al een op tekst gebaseerd PDF is, behandelt een PDF-cv herbouwen tot een bewerkbaar document het equivalente traject voor dat startpunt, en hoe je een cv schrijft behandelt de structuur die de moeite waard is om te controleren zodra de inhoud zelf is doorgekomen.
