從 PDF 中擷取頁面以供列印,意味著只將您實際需要的頁面複製到另一個獨立的 PDF 檔案中,這樣當您按下「列印」時,印表機就會依照您指定的順序,產生正好是該子集的輸出,而不是整份原始文件。「Extract PDF Pages」(擷取 PDF 頁面) 工具可直接在您的瀏覽器中完成這項工作:您挑選一個本機的 PDF,列出想要的頁碼或頁碼範圍,然後下載一個僅包含這些頁面的新檔案,其中的頁面圖形、裁切框 (crop box)、紙張框 (media box) 以及 90 度的旋轉,都會作為每個頁面物件的一部分被複製進去,而不是重新光柵化為影像。來源檔案、您的選擇以及產生的 PDF,全程都保留在您的裝置上;不會上傳任何內容到 Lizely。這個新檔案才是您要開啟並送往印表機的對象,這也正是這個方法如此實用的原因——例如,一份 90 頁的報告只需要第 20 到 30 頁,或是一份 200 頁的手冊只需要疑難排解章節。一旦新 PDF 下載完成,無論是單面、雙面,還是一張多頁的一般列印工作,就會從這個新檔案執行,而不是原始檔案。

extract pages from pdf for printing
擷取 PDF 頁面以供列印,無需浪費紙張

為什麼在列印前要先擷取頁面?

當列印工作所涉及的內容遠小於文件本身時,擷取就是正確的做法,而這種規模上的落差通常相當顯著。如果不先擷取就直接從一份冗長的 PDF 列印,就代表每次都得在印表機對話框中捲動、手動選擇自訂範圍,並依照文件預設的頁面順序,而非您想要的順序列印。擷取則會產生一個乾淨、小且可預測的檔案,可瞬間開啟並一路順暢列印,完全不必擔心有差一頁 (off-by-one) 的頁面偷偷溜進列印輸出中。

在幾個常見的情境中,一旦擷取工作先完成,後續的列印步驟就會變得快速許多:

  • 閱讀作業或章節。從一本 300 頁的教科書中抽出第 3 章,代表列印的是一個簡短的檔案,而不是手動選擇範圍並承擔印到相鄰章節頁面的風險。
  • 合約或報告的摘錄。僅將一份 60 頁提案書的第 4–8 頁送交給客戶,可讓列印輸出更聚焦,避免混入無關的段落。
  • 簡報講義。從一份夾雜會議記錄的混合 PDF 中抽出單一簡報檔,可避免印到那些根本不該作為講義的頁面。
  • 清理掃描檔。當掃描文件混雜著空白或重複的頁面時,只擷取有意義的頁面,就能產生更小、更乾淨的列印工作。

在所有這些情況下,列印對話框就不再需要去做那些檔案前置作業其實能處理得更好的工作。

Extract PDF Pages 的功能

Extract PDF Pages 工具會使用目前瀏覽器內的 pdf-lib 函式庫,從您選擇的頁面物件建構一份全新的 PDF。當您選擇一個檔案時,瀏覽器會驗證它是 PDF,且檔案大小不超過 50 MiB,然後在本機載入原始位元組,過程中不會將其傳送至任何地方。接著,您以想要的順序輸入要保留的頁碼,工具就會將每個選定頁面的物件——包括其圖形、紙張框、裁切框以及 90 度的旋轉——複製到一份新文件。這份新 PDF 會透過一個暫時的本機物件 URL 公開,讓您能儲存到磁碟。原始 PDF 維持不變,且有一個本機來源連結可讓您重新開啟以進行比較。關閉頁面或替換檔案會清除暫存資料。

如何擷取 PDF 頁面以供列印

  1. 開啟 Extract PDF Pages 工具並選擇您未加密的 PDF。檔案大小必須為 50 MiB 或以下,且頁數為 500 頁或以下。
  2. 等待工具在本機載入文件。瀏覽器不會上傳檔案;pdf-lib 會在目前的分頁中讀取位元組。
  3. 以您想要的列印順序輸入頁碼。請使用以 1 為起算的數字,並以逗號或空格分隔;範圍則使用連字號表示,例如「1, 3-5, 8」就會以該順序產生第 1、3、4、5 和 8 頁。
  4. 確認選取範圍。工具僅保留每個頁面的第一次出現,因此像「3, 1-3」這樣的重複會被視為「3, 1, 2」,重複的頁面也會被回報。
  5. 執行擷取。工具會將選定頁面的物件複製到一份新的 PDFDocument,並透過一個暫時的 URL 公開新位元組。
  6. 下載新的 PDF,在您慣用的檢視器中開啟,並在列印前確認頁數、順序與視覺呈現。
  7. 將新檔案送往您的印表機。針對這份新文件(而非原始檔案)調整印表機設定(單面或雙面、紙張大小、縮放比例)。

適用於列印就緒輸出的選取語法

解析器的規則相當嚴格,而這正是重點——任何被拒絕的詞元 (token),都能防止在您即將列印的檔案中誤加或漏掉某一頁。規則如下:

  • 頁碼以 1 為起算,與一般 PDF 檢視器所顯示的頁碼一致。
  • 詞元之間以逗號或空白字元分隔。
  • 連字號定義一個含首尾的遞增範圍,例如「3-5」。
  • 像「5-3」這種遞減範圍會被拒絕,而不會被自動反轉。
  • 小數值、負值、格式錯誤的範圍,以及超出載入文件範圍的頁碼,都會以明確的錯誤訊息被拒絕。
  • 詞元順序即為輸出順序。「5, 2-3」會先列印原始的第 5 頁,再列印第 2 與第 3 頁。
  • 重複的頁面遵循「首次出現」規則。「3, 1-3」會保留第 3、1、2 頁,並回報重複的部分。
  • 選取欄位最多接受 4,000 個字元。超過上限的輸入會被拒絕,而不會被截斷。

這對列印來說至關重要,因為輸出檔案中頁面的順序與存在與否,直接決定了印表機吐出的內容。以下列出幾個常見的選取項目及其對應的頁面集合。

選取項目新 PDF 包含的內容
1僅第 1 頁
3-5依序為第 3、4、5 頁
1, 3-5, 8第 1、3、4、5、8 頁
5, 2-3第 5、2、3 頁 (保留詞元順序)
3, 1-3第 3、1、2 頁 (重複的 3 已忽略,並回報)
5-3拒絕——遞減範圍

哪些內容會保留在新 PDF 中——又有哪些不會?

由於新檔案是重新建構的 PDF,而非原始檔案的螢幕截圖,頁面圖形、紙張框、裁切框以及 90 度的旋轉,都會作為每個選定頁面物件的一部分被複製——列印出的頁面應與原始頁面看起來一致。然而,檔案大小未必會與頁數成正比,因為像字型和影像這類共用資源,會在頁面需要時一併複製。一張從影像密集的文件中抽出的單頁,檔案仍可能很大;而擷取一頁時,也可能保留該頁實際用到的所有資料。

有幾項互動式或整份文件層級的功能可能無法完整保留,因為它們可能會參照到不在選定頁面中的物件:

  • 數位簽章。新文件的位元組已不同,因此簽章無法維持有效。
  • AcroForm 欄位、註解、連結和書籤。這些功能可能會依賴選定頁面以外的物件。
  • 頁面標籤與文件大綱。這些屬於整份文件層級,可能需要重新建構。
  • 內嵌檔案、圖層與跨頁目的地。原因同上。
  • 動態 XFA 表單。pdf-lib 不會保留 XFA 行為,而這些文件應交由原始的編輯軟體來處理。
  • 受密碼保護的檔案。無法略過加密機制,因此這類檔案將無法載入。

就列印工作而言,這通常無傷大雅——列印出來的頁面與來源頁面看起來一模一樣。只有在輸出需要維持與原始檔案一致的簽章、可導覽性或互動能力時,這點才會變得重要。下方彙整了決定此工具能否完成工作的邊界值。

邊界限制在邊界值時的行為
檔案大小50 MiB (52,428,800 位元組)剛好此大小的檔案會被接受;更大的檔案會被拒絕,而不會被縮減。
頁數500 頁剛好 500 頁的文件會被接受;更長的文件會被拒絕。
選取輸入4,000 字元超過上限的輸入會被拒絕,而不會被部分套用。
加密受密碼保護或加密的檔案不會被開啟。

擷取檔案的列印前檢查清單

在新檔案送往印表機之前,幾項快速的檢查可避免浪費紙張與墨水:

  1. 在最終列印時所使用的同一個檢視器中開啟新 PDF,並確認頁數符合您的選取範圍。
  2. 翻閱確認順序,確保詞元順序產生了您想要的序列。若順序有誤,請編輯選取範圍,而不是在列印對話框中調整順序。
  3. 檢查擷取頁面上的任何連結——若連結指向未擷取的頁面,則該目的地在列印輸出中將會遺失。
  4. 在印表機設定中,將紙張大小與擷取頁面的紙張框 (media box) 對齊。若原始檔案為 A4,但印表機預設為 Letter,請明確設定頁面大小,以免發生縮放或裁切。
  5. 將原始 PDF 留在手邊。新檔案是由選定的頁面物件建構而成,而非整份文件;若列印輸出有任何看起來不對勁之處,原始檔案仍是最具權威性的版本。
  6. 若為雙面列印工作,請在雙面列印設定中確認列印順序。像「8, 1-3」這種反向選取,在印表機預設的雙面列印邏輯下,可能會以出乎意料的順序列印;在執行大量列印前,請先試印一份。

若列印工作比一次性擷取更為複雜——例如兩頁並列的小冊子、一張多頁,或是分割成拼貼的海報——這類情況在擷取步驟之後,可交由不同的工具處理。然而,對於大多數日常的列印工作來說,先擷取頁面再列印,會比在印表機對話框中苦苦掙扎來得乾淨俐落,且新檔案小到足以用電子郵件寄送或歸檔,作為來源檔案的可列印版本。

相關閱讀:一次查詢多個檔案的紙張大小

相關閱讀:PDF 連結擷取入門教學