如何檢查AI能否讀懂你的履歷
作者 Aaron Cao · 更新於
打開PDF,全選文字,貼到純文字編輯器中。如果你的姓名、職稱和日期以合理的順序顯示出來,大多數解析器都能讀懂它。亂碼或什麼都貼不出來,就表示這個檔案是圖片。
測試一:複製貼上
這是最快的檢查方式,也能抓到最重要的那個失敗點。在任何PDF閱讀器中打開你的履歷,執行全選、複製,然後貼到純文字編輯器裡,例如macOS上的TextEdit或Windows上的Notepad。
把貼出來的內容當作你從未見過的文件來閱讀。有三種情況能告訴你答案:
- 什麼都貼不出來。檔案沒有文字層。它是一張履歷的圖片,通常是因為被掃描過、從設計工具匯出成圖片,或者是截圖。
- 文字貼得出來,但順序被打亂了。你的技能欄和工作經歷被逐行交錯在一起。解析器讀取它的方式,和你剛才看到的一樣。
- 文字按閱讀順序乾淨地貼出來。先是姓名,接著是聯絡方式,然後各部分依序排列。這才是你想要的結果。
缺漏一整段內容,和亂碼一樣值得留意。如果你的電話號碼在貼出的結果中始終沒有出現,那它很可能藏在頁首或文字方塊裡,對那些原本要用它聯絡你的軟體來說,這部分內容是看不到的。
測試二:讓模型把內容讀回給你
既然履歷篩選越來越仰賴語言模型,而不是關鍵字解析器,你可能會好奇乾淨的文字是否就夠了。答案是還不夠,第二個測試正是要補上這個缺口:與其檢查字元是否完整保留,不如檢查意義是否被完整保留。
把萃取出來的文字貼給任何聊天機器人,請它填一張表:目前職稱、雇主、每段經歷的起訖日期、總工作年資,以及前五項技能。然後把它的回答和事實對照一下。
你會得到很具體的資訊。如果它說錯了你目前的雇主,代表你的時間倒序排列不夠清楚。如果它給不出日期,代表你的日期格式不一致或被藏起來了。如果它列出的技能不是你希望這份工作看到的,代表它們在頁面上排得太後面了。
以一位透過某大型零售商徵才網站投遞履歷的資料分析師為例。她的PDF貼得很乾淨,所以她以為沒問題。但讀回測試卻把她目前的雇主判斷成了倒數第二份工作,原因是她把一段約聘工作放進了一個樣式不同、看起來像側邊欄的區塊裡。改一處排版就解決了問題。
每種失敗情況分別代表什麼,以及如何修復
上面的每一種結果,都對應著一個具體的原因。
- 沒有文字層。用文書處理軟體或履歷產生器重新製作履歷,並直接匯出成PDF。切勿列印成圖片或掃描列印稿。
- 欄位交錯。改用單欄排版。雙欄排版在人眼看來井然有序,但在解析器眼中會被讀成交替出現的片段。
- 聯絡方式缺漏。把它們從頁首或頁尾移出來,放到第一頁的內文裡。
- 整個段落缺漏。文字方塊、表格以及嵌入圖形中的文字會遺失。請使用一般段落和標準項目符號。
- 項目符號處出現奇怪字元。這是裝飾性字型或自訂字符所致。請換成標準字型和標準項目符號字元。
如果重新製作是解決辦法,/resume-builder提供的免費產生器預設就會匯出帶有真實文字層的單欄PDF,不用你費心就能消除前三種失敗情況。
這些測試無法告訴你的事
通過全部三項檢查,代表你的履歷是機器可讀的。但這不代表某個特定雇主的系統也會用同樣的方式處理它。不同解析器之間存在差異,有些徵才網站會把你上傳的內容重新處理進自己的表單欄位,還有一些在上傳後仍然要求你重新手動輸入全部內容。
這些測試也無法告訴你內容是否有說服力。乾淨的文字萃取只是讓你的文字進入了排名環節,並不能保證它們就是恰當的文字。這是另一個問題,其餘的履歷相關內容都在/answers/topic/resume裡。
有一個習慣值得保持:每次修改涉及排版的地方之後,都重新做一次複製貼上測試。換一種字型、加一個標誌,或是把某個段落挪進文字方塊,都可能悄悄破壞一份上個月還完全正常的履歷。