在 Adobe Acrobat 中從 PDF 擷取頁面,意即使用「組織頁面」工具,從來源文件中複製所選的一組頁面,並將其儲存為獨立的 PDF 檔案,而原始檔案則維持不變。在 Adobe Acrobat 中,你開啟「組織頁面」,在你要的頁面周圍拖曳出選取框,點選「擷取」,選擇「擷取這些頁面」,然後將產生的檔案儲存到你的電腦。基於瀏覽器的 Extract PDF Pages 工具能達成相同的結果——一份僅包含你所指定頁面、且依你所指定順序排列的新 PDF——但它完全在瀏覽器中執行,無需安裝 Acrobat。頁碼採 1 為起始編號,因此頁面 1 是文件的第一頁,使用逗號或空白字元分隔選取範圍,連字號則用於定義包含首尾的遞增範圍,例如 3-5。權杖的順序會予以保留:5, 2-3 會產生一份先有原始頁面 5、再接著頁面 2 與 3 的 PDF。重複的頁面遵循「首次出現」原則,重複部分會被回報,但不會重複加入。

how to extract pdf pages in adobe acrobat
how to extract pdf pages in adobe acrobat

在 Adobe Acrobat 中擷取 PDF 頁面的意義

擷取 PDF 頁面是指從一份 PDF 中複製出所選的頁面子集,並將該子集儲存為獨立的檔案。它與刪除頁面不同,後者會從原始檔案中移除內容;也和分割不同,後者會根據範圍產生多個輸出檔案。在 Acrobat 中,此動作位於「組織頁面」工作區,會產生一份僅包含你所選頁面的全新 PDF。來源檔案不會被修改。多數讀者會在需要將冗長報告中的一小段摘錄寄出、從手冊中隔離出某個章節,或是將單一表單頁面交給同事、又不讓對方看到文件其他內容時,選擇使用這項功能。

如何在 Adobe Acrobat 中擷取 PDF 頁面

若你已安裝 Acrobat,以下步驟可產生一份僅包含你所選頁面的獨立 PDF:

  1. 在 Adobe Acrobat 中開啟你的 PDF。
  2. 從右側的「工具」面板中,選擇「組織頁面」。若右側面板隱藏,可從「檢視」選單將其開啟,或使用 Acrobat 為該工具指定的鍵盤快速鍵。
  3. 在工作區中,於你要的縮圖頁面周圍拖曳出選取框;或在 Windows 上按住 Ctrl、在 macOS 上按住 Command 的同時點選個別縮圖,以建立非連續的選取範圍。
  4. 點選上方工具列中的「擷取」。
  5. 在「擷取」對話框中,確認選擇的是「擷取這些頁面」,而非「擷取全部」——後者會移除你所選範圍以外的所有頁面。
  6. 點選「擷取」,並在你的電腦上選擇一個目的資料夾。
  7. 在 Acrobat 中開啟新檔案,確認頁數與順序無誤後再進行分享。

此流程適用於未加密的 PDF。若來源檔案受密碼保護,Acrobat 會在「組織頁面」允許你擷取任何內容之前,先提示輸入密碼。Adobe 的網頁版 Acrobat 在「編輯 > 擷取頁面」下提供相同的動作,但其底層邏輯——將所選頁面複製到新檔案——是完全相同的。

在瀏覽器中使用 Extract PDF Pages 擷取頁面

對於沒有安裝 Acrobat,或不想啟動桌面應用程式而希望快速取得結果的讀者而言,Extract PDF Pages 工具可在瀏覽器中執行相同任務。來源檔案會在本機讀取,pdf-lib 會將頁面物件複製到一份新文件,新的 PDF 透過暫存物件 URL 提供下載。過程中不會上傳任何資料。

  1. 選擇一份不超過 50 MiB、且頁數不超過 500 頁的未加密 PDF。
  2. 依你想要的輸出順序,輸入以 1 為起始的頁碼或包含首尾的遞增範圍,例如 5, 1-3。
  3. 擷取不重複的所選頁面,檢視任何重複頁面的提示,然後下載新的 PDF。

由於新 PDF 是在本機建構的,因此你可以使用不同的選取範圍再次執行擷取,而不會動到來源檔案或先前的輸出結果。

頁面選取語法:權杖、範圍與順序

頁碼採 1 為起始編號,這表示文件的第一頁就是頁面 1,與 Acrobat 及其他 PDF 檢視器所顯示的編號一致。選取欄位接受以逗號或空白字元分隔的權杖,而連字號則用於定義包含首尾的遞增範圍。你輸入權杖的順序,即成為輸出中頁面的排列順序。例如,5, 2-3 會產生一份首頁為原始頁面 5,接著為原始頁面 2 與 3 的 PDF。這種重新排序的行為,當你需要將封面頁放在最前面、附錄放在最後,或是快速修正掃描時順序錯亂的章節時,會非常實用。

輸入意義輸出頁面
5單一頁面5
1-3包含首尾的遞增範圍1, 2, 3
5, 2-3權杖,順序保留5, 2, 3
3, 1-3依首次出現原則處理重複3, 1, 2 (回報重複)
5-3遞減範圍拒絕
1.5 或 -2格式錯誤的權杖拒絕
7(於 5 頁文件)超出已載入文件的頁面拒絕

重複的頁面遵循刻意設計的「首次出現」原則。輸入 3, 1-3 會先選取頁面 3,再選取頁面 1 與 2。頁面 3 的第二次出現將予以忽略,結果會回報此重複情形。這能避免因不慎重疊的範圍,而在無聲無息中於輸出加入重複的頁面,同時又能保留每個頁面首次出現的確切順序。若你需要在輸出中放入同一頁的重複複本,請使用專為此用途設計的PDF 頁面重新排序與複製工作流程

解析器的規則相當嚴格。遞減範圍(例如 5-3)會遭到拒絕,而不會被默默反轉為遞增。小數值、負值、格式錯誤的範圍,以及超出已載入文件的頁面,同樣會遭到拒絕,並顯示明確的錯誤訊息。選取欄位最多接受 4,000 個字元;超過上限的輸入不會被截斷或部分套用。

擷取後保留與變動的項目

90 度旋轉、裁切框、媒體框、頁面圖形,以及一般的頁面資源,都會作為每個所選頁面物件的一部分一併複製。根據 pdf-lib PDFDocument API,頁面複製會將每個頁面的內容串流與資源轉移至新文件。此工具不會將頁面光柵化為螢幕截圖,因此在新檔案中,文字仍可選取,向量圖形仍維持銳利。

部分 PDF 功能依賴於存在於所選頁面之外的物件。AcroForm 欄位、註解、指令碼、嵌入檔案、圖層、頁面標籤、書籤、文件大綱、跨頁目的地及連結,可能無法在擷取後完整保留。由於文件的已簽署位元組範圍已改變,建立新 PDF 後,數位簽章將不再有效。動態 XFA 表單並非 pdf-lib 所支援的保留目標,而 pdf-lib 正是此擷取工具所使用的底層程式庫。受密碼保護的檔案不會透過繞過加密的方式開啟;損壞或不受支援的檔案則可能無法載入。

在使用輸出檔案之前,請於目標檢視器中將其開啟,確認所選順序與頁面呈現,測試必要的連結或欄位,並保留原始 PDF。當需要保留簽章、XFA、無障礙結構、組合檔、附件,或符合受規範的歸檔要求時,請使用專業的 PDF 編輯器。

大小限制、錯誤與重複處理規則

輸入的上限為 50 MiB,等同於 52,428,800 位元組。解碼後文件的上限為 500 頁。恰好達到任一上限的檔案會被接受;更大的檔案或文件則會遭到拒絕,而不會被縮減。大小限制背後的計算很簡單:50 MiB × 1,024 KiB/MiB × 1,024 bytes/KiB = 52,428,800 bytes。

輸出檔案仍可能很大,因為所選頁面的資源(例如字型和影像)會一併複製;即使是僅選取一頁,資源密集的頁面仍可能保留大量資料。檔案大小並非與頁數成正比,從資源密集的文件中擷取一頁,仍可能保留該頁所需的資料。瀏覽器的可用記憶體也會因裝置與分頁的工作負荷而有所不同。

變更頁面運算式會立即釋放先前的結果,再次執行擷取會取代先前的輸出 URL。選擇其他檔案會清除舊的位元組、選取範圍、來源連結、結果與錯誤。工作與掛載狀態的保護機制可避免舊的非同步載入或儲存動作覆蓋較新的狀態,因此緩慢的載入不會覆寫你隨後輸入的、較快速的新選取範圍。

若你正在權衡各種選項,無需 Acrobat 即可鎖定表單欄位的 PDF 扁平化替代方案對此有詳細說明。

若你正在權衡各種選項,在 Acrobat 中重新排列 PDF 頁面:基於瀏覽器的方法對此有詳細說明。