儲存為 PDF 的 LinkedIn 個人檔案會保留頁面上原本就存在的可點擊連結註解 —— 包括網站 URL、公司連結、學校頁面以及聯絡 mailto 項目 —— 而基於瀏覽器的擷取工具可以依頁面順序列出所有支援的目標,無需上傳文件。LinkedIn 所產生的 PDF 版本並不僅僅是個人檔案的平面影像;它會在每個可點擊的文字或圖示背後儲存真正的連結註解,而這些註解正是擷取工具所讀取的內容。由於整個處理過程在本機透過 PDF.js 註解資料完成,因此原始的個人檔案 PDF 在全程都會留在你的電腦上。

人們會將 LinkedIn 個人檔案 PDF 透過連結擷取工具處理,基於幾個實際的原因。招募人員與用人主管希望驗證候選人所提供的個人網站或作品集 URL 是否仍指向正確的位置。求職者希望能將聯絡人個人檔案中的所有連結複製到自己的筆記中。部分使用者只是想要一份簡潔的聯絡人與專案清單,以便分享到其他地方。在每一種情況下,目標都相同:將一份人類可以透過點擊瀏覽的 PDF,轉換成一份你可以閱讀、排序或貼到任何地方的平面 URL 清單。

how to get pdf linkedin profile
如何從 LinkedIn 個人檔案 PDF 中擷取支援的連結

LinkedIn 個人檔案 PDF 實際上包含什麼

LinkedIn 的「另存為 PDF」功能會產生一份多頁文件,反映公開個人檔案的結構。該 PDF 包含標題、關於(About)區塊、工作經歷、教育背景、證照與認證、專案以及推薦內容 —— 每一項都以與線上頁面相同的可點擊元素呈現。當你從桌面版網站將個人檔案儲存為 PDF 時,產生的檔案會將這些元素儲存為 PDF 連結註解,而非純文字。這就是真正的可點擊連結,與僅僅看起來像連結的 URL 之間的技術差異。

你通常可以在 LinkedIn 個人檔案 PDF 內找到以下連結:

  • 聯絡區塊或關於區塊中的個人網站與作品集 URL
  • 每位現任與前任雇主的公司檔案頁面
  • 教育區塊中的學校與大學檔案頁面
  • 如果檔案所有者有填寫,則包含專案與出版品的頁面
  • 以 mailto: 與 tel: 為目標的電子郵件與電話連結

這些目標各自存在於一個 PDF 連結註解中,附帶目標字串與可選的註解類型。擷取工具會逐頁瀏覽,向 PDF.js 索取該頁的註解,並讀取支援的欄位 —— 它並不會從印刷文字中掃描任何看起來像 URL 的內容。

擷取工具如何從 PDF 中提取可點擊目標

PDF 連結擷取工具只會在你明確選擇檔案並按下「擷取連結」按鈕後,才會載入來源 PDF。PDF.js 及其共用 worker 為按需載入,獨立於初始頁面套件之外,因此在你採取行動之前不會擷取任何額外資源。一旦開始擷取,工具會向 PDF.js 請求每一頁的註解,並僅保留代表支援之連結註解的部分。

在將個人檔案送進工具之前,有三個行為值得了解:

  • 註解,而非文字掃描。由於擷取工具讀取的是 PDF.js 註解資料,而非在原始 PDF 位元組中搜尋類似 URL 的字串,因此不會因為壓縮串流、字型資料、中繼資料或一般印刷文字而產生誤判。印在頁面上但從未設為可點擊的 URL 可能不會出現,因為在 PDF 物件模型中,它並非連結註解。
  • 通訊協定過濾。外部目標僅在使用 HTTP、HTTPS、mailto 或 tel 時才會被接受。該檢查不區分大小寫,並會拒絕任何包含控制字元的目標。JavaScript、data、file、blob 及其他未經核准的通訊協定會被略過,而不會以可點擊文字的形式顯示。
  • 內部目的地。PDF 中的某些連結指向同一份文件中的其他位置,而非網址。報告會將這些標示為內部目標,並以有界限且可讀的表示形式序列化;由於不同檢視器的 PDF 目的地結構各異,它並不保證能將每個內部目的地解析為最終的頁碼。

從 LinkedIn 個人檔案 PDF 擷取連結:逐步說明

在桌面瀏覽器中開啟 PDF 連結擷取工具。該工具完全在你的裝置上執行,因此沒有帳號、沒有上傳步驟,也不會在原始檔案上加入浮水印。

  1. 選擇 LinkedIn 個人檔案 PDF。點擊檔案選擇器,從你的下載資料夾中選擇 LinkedIn「另存為 PDF」的檔案。該工具一次僅接受一份文件,大小上限為 25 MiB,頁數上限為 40 頁;加密、損壞、不支援或超出限制的檔案會以明顯的錯誤訊息被拒絕,且原始檔案保持不變。
  2. 按下「擷取連結」。該按鈕會按需載入 PDF.js,並逐頁處理文件。進度會反映每一頁正在被檢查,以及其註解正在被篩選為支援的連結類型。
  3. 在瀏覽器中檢視報告。結果會依頁面順序出現,並在每頁內保留註解順序。每一列顯示頁碼、註解編號、連結類型與目標。同一頁上的完全重複項目會自動移除,而不同頁面上的重複連結則會保留,因為該頁出現次數是有用的佐證。
  4. 複製或下載報告。使用複製動作將中性的純文字報告抓進剪貼簿,或下載 CSV 或 UTF-8 TXT 檔。CSV 包含頁碼、註解編號、類型與目標欄位,其中可能觸發公式的前綴值已中和,引號與換行符號依 CSV 規則跳脫 —— 因此擷取出的目標在日後開啟時,不會意外地被當作試算表公式執行。
  5. 將原始 PDF 儲存為你的紀錄。擷取工具不會修改來源檔案。請將下載的 LinkedIn 個人檔案 PDF 原封不動地保留,作為事實來源,並將匯出的報告視為一份衍生的清單,日後當個人檔案變更時可以隨時重新產生。

解讀報告:欄位、通訊協定與內部目標

螢幕上的報告與下載的檔案使用相同的中性純文字目標 —— 該工具絕不會前往、擷取、驗證或對任何擷取出的目的地進行信譽檢查。這個區別很重要:一份連結出現在報告中,只能證明 PDF.js 公開了支援的連結註解,並不代表該 URL 可連線、安全或仍然準確。

欄位說明內容範例
頁碼找到該註解的頁碼3
註解編號該頁上註解的位置7
類型外部或內部連結註解外部
目標經通訊協定過濾後的中性 URL 或目的地https://example.com/portfolio

外部目標在通訊協定過濾器接受後,會以其完整 URL 字串顯示。內部目標會被標示為內部目標,並可能顯示一個具名目的地(一個可讀的標籤,例如 section.experience)或一個明確的目的地陣列 —— 即同一份 PDF 內部的結構化參照。部分內部目的地並不總能解析為最終頁碼,因此報告刻意止步於一個有界限、可讀的表示形式,而不進行猜測。

限制、錯誤與工具不會做的事

擷取工具刻意設有邊界。來源檔案限制為 25 MiB 與 40 頁,且對每頁檢查的註解數量、每個目標字串的長度,以及報告的總大小皆設有上限。這些上限是為了避免單一文件造成無止境的工作量或輸出。若個人檔案 PDF 超出任何限制,或是加密、損壞,或處於 PDF.js 無法解析的結構,工具會回傳一個明顯的錯誤,且不會產生部分報告。

同樣值得了解的是,工具刻意不會執行的事項,因為這些項目正是它能在可能含有個人資訊的個人檔案 PDF 上安全使用的部分原因:

  • 它不會將你的 PDF 上傳到任何地方;該文件與所有擷取出的目標都會保留在你的裝置上。
  • 它不會造訪、驗證或對任何擷取出的 URL 進行信譽檢查。
  • 它不會執行失效連結檢查、釣魚掃描、無障礙稽核或內容掃描。
  • 它不會在 PDF 文字中搜尋形似 URL 的字串;僅有真正的連結註解會被計算在內。
  • 它不會修改原始 PDF;來源檔案保持不變,作為你的紀錄。

將擷取出的清單實際加以運用

一旦你取得了乾淨的 CSV 或 TXT,便能展開幾個常見的工作流程。招募人員可以將目標貼進追蹤表,以便後續追蹤作品集連結。正在建立個人網站的求職者,可以將已驗證的 URL 複製到他們自己的資源清單中。任何檢視自己個人檔案的人,都能確認他們預期要分享的每一個連結 —— 作品集、部落格、GitHub、公司頁面 —— 確實出現在 PDF 匯出檔中。

對於敏感的個人檔案,請將匯出的報告視為與原始 PDF 相同等級的對待:以不信任的、來自文件的衍生資料來處理。CSV 的公式保護代表檔案在開啟時不會執行試算表公式,但 URL 字串本身仍來自外部來源,在造訪或轉發之前仍應加以驗證。

若你需要對同一份檔案取得不同的檢視,PDF 頁數計算工具可以精準告訴你該個人檔案 PDF 有多少頁,讓你在執行前先確認是否符合 40 頁的擷取上限。若想完全移除可點擊圖層,得到一份更平面、更不可點擊的文件版本,你可以接續使用 PDF 註解移除工具。兩者皆在本機執行,因此同樣的隱私保證貫穿全程。