把一份旧的PDF简历重建成可编辑文档,意味着PDF只被读取一次,转换成你可以点击并修改的结构化内容,从那一刻起,PDF文件本身就不再重要了:你编辑的是结构化版本,而不是原始文件。整个流程是上传、提取、检查、编辑,完成后再下载一份新的PDF。一份格式良好的简历,大部分内容都能顺利完成这个流程。少数内容,通常是原始PDF出于视觉效果而非结构原因做出的排版选择,事后往往需要人工检查一下。
上传PDF后会发生什么
CVBuilderKit从不存储PDF文件本身。浏览器会从中读取文字;由于PDF不像纯文本文件那样拥有可靠的结构,浏览器还会把每一页渲染成一张图像,让提取步骤不仅能看到文字,还能看到版式。只有提取出的文字和这些页面图像会被发送出去,别无其他,原始文件的任何痕迹之后都不会留存。超过四页的PDF只有前四页会以这种方式被读取,因此篇幅较长的简历在上传前最好先精简,而不要指望后面的页面也会被读到。
通常能顺利导入的内容
上方有清晰标题的倒序时间顺序板块导入效果很好,因为标题本身就是提取步骤能够依赖的最强信号之一。职位名称、雇主、日期和成就类要点几乎总能落到正确的位置,因为无论原始文档如何设计,它们都遵循一种可预测的形态。顶部的摘要段落通常也能完整保留下来,只要它读起来是一整块连贯的文字,而不是被拆散在一个侧边栏里。
几乎总是需要人工检查的内容
原始PDF纯粹出于视觉效果而安排的任何内容,而不是因为它在结构上本就属于那里,往往需要再看一眼。一种双栏排版,其中一个技能侧边栏沿页面延伸,与工作经历并排,阅读顺序可能会被打乱,因为PDF并没有内置"先完整读完这一栏,再开始读另一栏"这种概念。用图标代替文字作为板块标题,或者把联系方式排成图形而不是文字,也可能因为同样的原因被遗漏,仅仅是因为那里原本就没有可供提取的文字。
示例说明:一个顺利导入的板块,一个没能顺利导入的板块
像"后端工程师,Acme公司,2021-2024"这样的单栏工作经历条目,后面跟着三个要点,通常会逐条顺利导入到对应的结构化字段中。
一个把候选人姓名以图形化字体写在彩色图案里的装饰性标题,真正的联系方式则用极小的字体排在每个小图标旁边,是事后最有可能需要人工检查的板块,原因很简单:图标和图案本身都没有可供提取的文字。
导入之后,下载之前
导入完成后,像招聘人员那样通读一遍结果:从上到下,检查板块顺序是否仍然合理,原文中重要的内容是否有遗漏或错乱。日期和数字尤其值得再看一遍,因为日期范围里颠倒的一个数字,正是那种容易出现、又容易在快速浏览时被漏掉的错误。免费账户每天最多可以把完成的简历下载为PDF三次,因此在把其中一次下载额度用在一个仍需修改的版本之前,值得先在编辑器里完整检查一遍文档。
开始重建
一份旧的PDF不必成为死胡同。上传一次,检查排版最可能出错的板块,开始编辑一份可以再次更新的文档,往后每当你的履历发生变化时都能沿用,而不必等到下次需要时再从零开始重建。重建后的简历应遵循的总体结构,与如何写一份简历中介绍的结构相同,等内容本身稳定下来后,也值得看看完整的模板列表。
