Cuando la única copia de tu currículum es una imagen escaneada o una foto de móvil en lugar de un archivo de texto, CVBuilderKit igualmente la lee, pero lo que ocurre después depende de cuál de los dos tengas en realidad. A un PDF escaneado o fotografiado se le lee la capa de texto igual que a cualquier PDF, hasta sus primeras cuatro páginas, y cada una de esas páginas también se convierte en imagen junto con cualquier texto encontrado, ya que una página sin una capa de texto real debajo de otro modo se importaría en blanco. Una sola foto de una página, guardada directamente como archivo PNG, JPEG o WEBP en lugar de envuelta en un PDF, se salta por completo el paso de lectura de texto y se envía como una única imagen. En cualquier caso, obtener un resultado utilizable empieza por la calidad de la imagen de origen, no por nada que el paso de importación pueda arreglar después.
En qué se diferencia un PDF escaneado de una imagen fotografiada
Un PDF escaneado, producido por una aplicación de escaneo o un escáner de documentos, puede llevar o no una capa de texto real bajo la imagen de la página, según si la aplicación que lo creó ejecutó o no algún tipo de reconocimiento de texto propio. La importación de CVBuilderKit no necesita que esa capa de texto exista: siempre intenta leer texto de hasta las primeras cuatro páginas de cualquier PDF, y siempre convierte esas mismas páginas en imágenes también, así que un PDF escaneado sin texto utilizable debajo igualmente llega como un conjunto de imágenes de página que el paso de extracción puede leer visualmente. Un archivo de foto suelto subido por sí solo funciona de forma distinta. Como no tiene ninguna estructura de página de la que extraer texto en primer lugar, se envía puramente como una imagen, sin que se intente ningún paso de lectura de texto en absoluto. La diferencia práctica es el número de páginas: un PDF puede llevar varias páginas de un documento escaneado a la vez, mientras que un archivo de foto independiente siempre representa solo la única página de la que es foto.
Conseguir un origen legible antes de subirlo
Una foto plana, iluminada de forma uniforme y recortada de una página da de forma consistente un resultado más limpio que una foto tomada con prisa. Aplanar una página en lugar de fotografiarla con una curvatura o un pliegue evita introducir una deformación en el texto que un escaneo recto nunca tiene. Una luz uniforme y difusa en lugar de un flash directo mantiene los reflejos alejados del papel brillante, ya que un reflejo intenso situado justo encima de una línea de texto puede hacer que esa línea sea realmente ilegible en la imagen resultante. Recortar la foto aproximadamente a los bordes de la propia página, en lugar de incluir un margen amplio de mesa o fondo alrededor, mantiene el texto real lo más grande y detallado posible dentro de la resolución que el navegador acaba enviando, ya que una foto se redimensiona automáticamente antes de enviarse y una página bien recortada conserva más de esa resolución trabajando sobre el propio texto. También merece la pena mantener una página por imagen, en lugar de intentar encajar dos páginas una junto a otra en una sola foto, ya que el texto de cada página individual acaba siendo más pequeño y más difícil de leer en cuanto dos páginas comparten el mismo encuadre.
Un archivo cada vez: combinar varias páginas en un solo PDF
La subida siempre acepta un único archivo cada vez, así que una foto subida por sí sola solo aporta la única página que muestra, nada más. Si un currículum ocupa más de una página fotografiada, la vía práctica es combinar esas fotos separadas en un único PDF de varias páginas antes de subirlo, usando la propia función de escaneo de documentos del móvil o una aplicación de escaneo similar, en lugar de intentar subir las páginas una a una. Un PDF combinado se lee entonces hasta sus primeras cuatro páginas juntas, texto e imágenes a la vez, en una sola importación, mientras que una serie de subidas de fotos separadas solo sustituiría cada vez la que ya está en la página, en lugar de sumarse hasta formar un documento de varias páginas.
Qué sigue siendo necesario comprobar tras una importación basada en imagen
Como no había ningún texto subyacente que extraer en el caso de una imagen pura o una página escaneada sin texto, cada línea que devuelve el paso de extracción para ese tipo de origen proviene de leer la propia imagen en lugar de copiar un texto digital fiable, así que una relectura cuidadosa después importa aquí todavía más que con un PDF basado en texto, un punto de partida tratado con más detalle en reconstruir un currículum PDF en un documento editable. Los números y las fechas merecen una segunda mirada específica. Un dígito leído como otro dígito distinto a partir de una foto ligeramente borrosa o mal iluminada es exactamente el tipo de pequeño error que resulta fácil de introducir en esta etapa y fácil de pasar por alto de nuevo en una revisión rápida después.
Ejemplo ilustrativo: un campo que necesita revisión manual tras una importación de imagen
Ejemplo ilustrativo. Una página de currículum fotografiada muestra un número de teléfono compuesto en una tipografía ligeramente borrosa y de bajo contraste en el encabezado, junto a un pequeño icono en lugar de una etiqueta de texto. Tras una importación basada en imagen, todo lo demás en esa página, los puestos de trabajo, las viñetas, las fechas puestas más abajo en la página con una tipografía más clara y de mayor contraste, se lee correctamente, pero el número de teléfono llega con un dígito transpuesto, ya que una foto borrosa deja incluso a una lectura cuidadosa menos con lo que trabajar que el texto impreso nítido en cualquier otro lugar de esa misma página. Ese único campo es exactamente el tipo de detalle que merece una comprobación específica antes de enviar el currículum a cualquier sitio, en lugar de asumir que la lectura de todo el documento fue tan limpia como las partes que fueron más fáciles de fotografiar bien.
Empieza la reconstrucción
Un currículum escaneado o fotografiado no tiene por qué ser un callejón sin salida solo porque el origen no sea texto. Haz una foto plana, bien iluminada y recortada de cada página, combina más de una página en un solo PDF primero si las tienes, y empieza la reconstrucción. Para un origen que ya es un PDF basado en texto, reconstruir un currículum PDF en un documento editable trata el recorrido equivalente para ese punto de partida, y cómo escribir un currículum trata la estructura que merece revisarse una vez que el propio contenido ha llegado.
