Quando l'unica copia del tuo curriculum è un'immagine scansionata o una foto dal telefono invece di un file di testo, CVBuilderKit la legge comunque, ma quello che succede dopo dipende da quale dei due hai realmente. Un PDF scansionato o fotografato viene letto nel suo strato di testo come qualsiasi altro PDF, fino alle prime quattro pagine, e ciascuna di quelle pagine viene anche resa come immagine insieme a qualsiasi testo trovato, dato che una pagina senza un vero strato di testo sotto verrebbe altrimenti importata vuota. Una singola foto di una pagina, salvata direttamente come file PNG, JPEG o WEBP invece che racchiusa in un PDF, salta del tutto il passaggio di lettura del testo e viene inviata come un'unica immagine. In entrambi i casi, ottenere un risultato utilizzabile parte dalla qualità dell'immagine sorgente, non da qualcosa che il passaggio di importazione possa correggere dopo.
In cosa un PDF scansionato differisce da un'immagine fotografata
Un PDF scansionato, prodotto da un'app di scansione o da uno scanner di documenti, può avere o non avere un vero strato di testo sotto l'immagine della pagina, a seconda che l'app che l'ha creato abbia eseguito o meno un proprio riconoscimento del testo. L'importazione di CVBuilderKit non ha bisogno che quello strato di testo esista: tenta sempre di leggere il testo dalle prime quattro pagine di qualsiasi PDF, e rende sempre anche quelle stesse pagine come immagini, quindi un PDF scansionato senza testo utilizzabile sotto arriva comunque come un insieme di immagini di pagina che il passaggio di estrazione può leggere visivamente. Un semplice file foto caricato da solo funziona diversamente. Non avendo alcuna struttura di pagina da cui estrarre testo in primo luogo, viene inviato puramente come un'immagine, senza che venga tentato alcun passaggio di lettura del testo. La differenza pratica è il numero di pagine: un PDF può portare più pagine di un documento scansionato contemporaneamente, mentre un file foto a sé stante rappresenta sempre solo l'unica pagina di cui è foto.
Ottenere una fonte leggibile prima di caricare
Una foto piatta, illuminata in modo uniforme e ritagliata di una pagina dà sistematicamente un risultato più pulito di una foto scattata di fretta. Appiattire una pagina invece di fotografarla con una curvatura o una piega evita di introdurre una distorsione sul testo che una scansione dritta non ha mai. Una luce uniforme e diffusa invece di un flash diretto tiene i riflessi lontani dalla carta lucida, perché un riflesso luminoso posizionato proprio sopra una riga di testo può davvero rendere quella riga illeggibile nell'immagine risultante. Ritagliare la foto circa ai bordi della pagina stessa, invece di includere un ampio margine di scrivania o sfondo intorno, mantiene il testo effettivo il più grande e dettagliato possibile entro la risoluzione che il browser finisce per inviare, dato che una foto viene ridimensionata automaticamente prima di essere inviata e una pagina ritagliata strettamente conserva più di quella risoluzione al servizio del testo stesso. Vale la pena attenersi anche a una pagina per immagine, invece di provare a far stare due pagine affiancate in una sola foto, perché il testo di ogni singola pagina finisce per essere più piccolo e più difficile da leggere una volta che due pagine condividono la stessa inquadratura.
Un file alla volta: unire più pagine in un unico PDF
Il caricamento accetta sempre un solo file alla volta, quindi una foto caricata da sola contribuisce solo con l'unica pagina che mostra, niente di più. Se un curriculum si estende su più di una pagina fotografata, la via pratica è unire quelle foto separate in un unico PDF multipagina prima di caricare, usando la funzione di scansione documenti del telefono stesso o un'app di scansione simile, invece di provare a caricare le pagine una alla volta. Un PDF unito viene poi letto fino alle sue prime quattro pagine insieme, testo e immagini insieme, in un'unica importazione, mentre una serie di caricamenti di foto separate sostituirebbe ogni volta solo quella già presente sulla pagina invece di sommarsi in un documento multipagina.
Cosa va ancora controllato dopo un'importazione basata su immagine
Poiché non c'era alcun testo sottostante da estrarre nel caso di un'immagine pura o di una pagina scansionata senza testo, ogni riga che il passaggio di estrazione restituisce per quel tipo di fonte proviene dalla lettura dell'immagine stessa invece che dalla copia di testo digitale affidabile, quindi una rilettura attenta dopo conta qui ancora di più che con un PDF basato su testo, un punto di partenza trattato più nel dettaglio in ricostruire un curriculum PDF in un documento modificabile. Numeri e date meritano un secondo sguardo specifico. Una cifra letta come una cifra diversa da una foto leggermente sfocata o mal illuminata è esattamente il tipo di piccolo errore facile da introdurre in questa fase e facile da perdere di nuovo in una scorsa veloce dopo.
Esempio illustrativo: un campo che richiede un controllo manuale dopo un'importazione da immagine
Esempio illustrativo. Una pagina di curriculum fotografata mostra un numero di telefono composto in un carattere leggermente sfocato e a basso contrasto nell'intestazione, accanto a una piccola icona invece che a un'etichetta di testo. Dopo un'importazione basata su immagine, tutto il resto in quella pagina, i titoli di lavoro, i punti elenco, le date poste più in basso nella pagina in un carattere più chiaro e ad alto contrasto, si legge correttamente, ma il numero di telefono arriva con una cifra trasposta, dato che una foto sfocata lascia anche a una lettura attenta meno materiale su cui lavorare rispetto al testo stampato nitido ovunque altrove nella stessa pagina. Quel singolo campo è esattamente il tipo di dettaglio che merita un controllo specifico prima di inviare il curriculum da qualche parte, invece di dare per scontato che la lettura dell'intero documento sia andata bene quanto le parti più facili da fotografare bene.
Inizia la ricostruzione
Un curriculum scansionato o fotografato non deve restare un vicolo cieco solo perché la fonte non è testo. Scatta una foto piatta, ben illuminata e ritagliata di ogni pagina, unisci prima più pagine in un unico PDF se ne hai, e inizia la ricostruzione. Per una fonte che è già un PDF basato su testo, ricostruire un curriculum PDF in un documento modificabile tratta il percorso equivalente per quel punto di partenza, e come scrivere un curriculum tratta la struttura che merita di essere controllata una volta che il contenuto stesso è arrivato.
