儲存為 PDF 的 LinkedIn 個人檔案會保留頁面上原本就存在的可點擊連結註解 —— 包括網站 URL、公司連結、學校頁面以及聯絡 mailto 項目 —— 而基於瀏覽器的擷取工具可以依頁面順序列出所有支援的目標,無需上傳文件。LinkedIn 所產生的 PDF 版本並不僅僅是個人檔案的平面影像;它會在每個可點擊的文字或圖示背後儲存真正的連結註解,而這些註解正是擷取工具所讀取的內容。由於整個處理過程在本機透過 PDF.js 註解資料完成,因此原始的個人檔案 PDF 在全程都會留在你的電腦上。
人們會將 LinkedIn 個人檔案 PDF 透過連結擷取工具處理,基於幾個實際的原因。招募人員與用人主管希望驗證候選人所提供的個人網站或作品集 URL 是否仍指向正確的位置。求職者希望能將聯絡人個人檔案中的所有連結複製到自己的筆記中。部分使用者只是想要一份簡潔的聯絡人與專案清單,以便分享到其他地方。在每一種情況下,目標都相同:將一份人類可以透過點擊瀏覽的 PDF,轉換成一份你可以閱讀、排序或貼到任何地方的平面 URL 清單。

LinkedIn 個人檔案 PDF 實際上包含什麼
LinkedIn 的「另存為 PDF」功能會產生一份多頁文件,反映公開個人檔案的結構。該 PDF 包含標題、關於(About)區塊、工作經歷、教育背景、證照與認證、專案以及推薦內容 —— 每一項都以與線上頁面相同的可點擊元素呈現。當你從桌面版網站將個人檔案儲存為 PDF 時,產生的檔案會將這些元素儲存為 PDF 連結註解,而非純文字。這就是真正的可點擊連結,與僅僅看起來像連結的 URL 之間的技術差異。
你通常可以在 LinkedIn 個人檔案 PDF 內找到以下連結:
- 聯絡區塊或關於區塊中的個人網站與作品集 URL
- 每位現任與前任雇主的公司檔案頁面
- 教育區塊中的學校與大學檔案頁面
- 如果檔案所有者有填寫,則包含專案與出版品的頁面
- 以 mailto: 與 tel: 為目標的電子郵件與電話連結
這些目標各自存在於一個 PDF 連結註解中,附帶目標字串與可選的註解類型。擷取工具會逐頁瀏覽,向 PDF.js 索取該頁的註解,並讀取支援的欄位 —— 它並不會從印刷文字中掃描任何看起來像 URL 的內容。
擷取工具如何從 PDF 中提取可點擊目標
PDF 連結擷取工具只會在你明確選擇檔案並按下「擷取連結」按鈕後,才會載入來源 PDF。PDF.js 及其共用 worker 為按需載入,獨立於初始頁面套件之外,因此在你採取行動之前不會擷取任何額外資源。一旦開始擷取,工具會向 PDF.js 請求每一頁的註解,並僅保留代表支援之連結註解的部分。
在將個人檔案送進工具之前,有三個行為值得了解:
- 註解,而非文字掃描。由於擷取工具讀取的是 PDF.js 註解資料,而非在原始 PDF 位元組中搜尋類似 URL 的字串,因此不會因為壓縮串流、字型資料、中繼資料或一般印刷文字而產生誤判。印在頁面上但從未設為可點擊的 URL 可能不會出現,因為在 PDF 物件模型中,它並非連結註解。
- 通訊協定過濾。外部目標僅在使用 HTTP、HTTPS、mailto 或 tel 時才會被接受。該檢查不區分大小寫,並會拒絕任何包含控制字元的目標。JavaScript、data、file、blob 及其他未經核准的通訊協定會被略過,而不會以可點擊文字的形式顯示。
- 內部目的地。PDF 中的某些連結指向同一份文件中的其他位置,而非網址。報告會將這些標示為內部目標,並以有界限且可讀的表示形式序列化;由於不同檢視器的 PDF 目的地結構各異,它並不保證能將每個內部目的地解析為最終的頁碼。
從 LinkedIn 個人檔案 PDF 擷取連結:逐步說明
在桌面瀏覽器中開啟 PDF 連結擷取工具。該工具完全在你的裝置上執行,因此沒有帳號、沒有上傳步驟,也不會在原始檔案上加入浮水印。
- 選擇 LinkedIn 個人檔案 PDF。點擊檔案選擇器,從你的下載資料夾中選擇 LinkedIn「另存為 PDF」的檔案。該工具一次僅接受一份文件,大小上限為 25 MiB,頁數上限為 40 頁;加密、損壞、不支援或超出限制的檔案會以明顯的錯誤訊息被拒絕,且原始檔案保持不變。
- 按下「擷取連結」。該按鈕會按需載入 PDF.js,並逐頁處理文件。進度會反映每一頁正在被檢查,以及其註解正在被篩選為支援的連結類型。
- 在瀏覽器中檢視報告。結果會依頁面順序出現,並在每頁內保留註解順序。每一列顯示頁碼、註解編號、連結類型與目標。同一頁上的完全重複項目會自動移除,而不同頁面上的重複連結則會保留,因為該頁出現次數是有用的佐證。
- 複製或下載報告。使用複製動作將中性的純文字報告抓進剪貼簿,或下載 CSV 或 UTF-8 TXT 檔。CSV 包含頁碼、註解編號、類型與目標欄位,其中可能觸發公式的前綴值已中和,引號與換行符號依 CSV 規則跳脫 —— 因此擷取出的目標在日後開啟時,不會意外地被當作試算表公式執行。
- 將原始 PDF 儲存為你的紀錄。擷取工具不會修改來源檔案。請將下載的 LinkedIn 個人檔案 PDF 原封不動地保留,作為事實來源,並將匯出的報告視為一份衍生的清單,日後當個人檔案變更時可以隨時重新產生。
解讀報告:欄位、通訊協定與內部目標
螢幕上的報告與下載的檔案使用相同的中性純文字目標 —— 該工具絕不會前往、擷取、驗證或對任何擷取出的目的地進行信譽檢查。這個區別很重要:一份連結出現在報告中,只能證明 PDF.js 公開了支援的連結註解,並不代表該 URL 可連線、安全或仍然準確。
| 欄位 | 說明內容 | 範例 |
|---|---|---|
| 頁碼 | 找到該註解的頁碼 | 3 |
| 註解編號 | 該頁上註解的位置 | 7 |
| 類型 | 外部或內部連結註解 | 外部 |
| 目標 | 經通訊協定過濾後的中性 URL 或目的地 | https://example.com/portfolio |
外部目標在通訊協定過濾器接受後,會以其完整 URL 字串顯示。內部目標會被標示為內部目標,並可能顯示一個具名目的地(一個可讀的標籤,例如 section.experience)或一個明確的目的地陣列 —— 即同一份 PDF 內部的結構化參照。部分內部目的地並不總能解析為最終頁碼,因此報告刻意止步於一個有界限、可讀的表示形式,而不進行猜測。
限制、錯誤與工具不會做的事
擷取工具刻意設有邊界。來源檔案限制為 25 MiB 與 40 頁,且對每頁檢查的註解數量、每個目標字串的長度,以及報告的總大小皆設有上限。這些上限是為了避免單一文件造成無止境的工作量或輸出。若個人檔案 PDF 超出任何限制,或是加密、損壞,或處於 PDF.js 無法解析的結構,工具會回傳一個明顯的錯誤,且不會產生部分報告。
同樣值得了解的是,工具刻意不會執行的事項,因為這些項目正是它能在可能含有個人資訊的個人檔案 PDF 上安全使用的部分原因:
- 它不會將你的 PDF 上傳到任何地方;該文件與所有擷取出的目標都會保留在你的裝置上。
- 它不會造訪、驗證或對任何擷取出的 URL 進行信譽檢查。
- 它不會執行失效連結檢查、釣魚掃描、無障礙稽核或內容掃描。
- 它不會在 PDF 文字中搜尋形似 URL 的字串;僅有真正的連結註解會被計算在內。
- 它不會修改原始 PDF;來源檔案保持不變,作為你的紀錄。
將擷取出的清單實際加以運用
一旦你取得了乾淨的 CSV 或 TXT,便能展開幾個常見的工作流程。招募人員可以將目標貼進追蹤表,以便後續追蹤作品集連結。正在建立個人網站的求職者,可以將已驗證的 URL 複製到他們自己的資源清單中。任何檢視自己個人檔案的人,都能確認他們預期要分享的每一個連結 —— 作品集、部落格、GitHub、公司頁面 —— 確實出現在 PDF 匯出檔中。
對於敏感的個人檔案,請將匯出的報告視為與原始 PDF 相同等級的對待:以不信任的、來自文件的衍生資料來處理。CSV 的公式保護代表檔案在開啟時不會執行試算表公式,但 URL 字串本身仍來自外部來源,在造訪或轉發之前仍應加以驗證。
若你需要對同一份檔案取得不同的檢視,PDF 頁數計算工具可以精準告訴你該個人檔案 PDF 有多少頁,讓你在執行前先確認是否符合 40 頁的擷取上限。若想完全移除可點擊圖層,得到一份更平面、更不可點擊的文件版本,你可以接續使用 PDF 註解移除工具。兩者皆在本機執行,因此同樣的隱私保證貫穿全程。