若要將原始圖片從 .docx 檔案中取出,您只需要一個基於瀏覽器的擷取工具,它能開啟文件套件內部的 word/media 資料夾,並逐字拷貝每個嵌入的圖片檔,保留周圍的文字、排版與文件 XML 不受影響。現代的 Word 文件其實就是依照 Office Open XML 標準所建立的 ZIP 封存檔,作者放入內文的每張照片、標誌、簽名掃描檔或圖表,通常都以獨立且自成一體的圖片元件存在於該封存檔中,而非直接烘焙到頁面像素裡。正因為這樣的結構,頁面截圖並不等同於您實際插入的圖片:截圖會包含頁面邊界、可能改變圖形大小、可能失去透明度,並將結果壓縮成扁平的點陣圖,而原始資料則仍維持完整的解析度與中繼資料,是 PNG 或 JPEG 格式。像 Extract Images from Word 這類專用的擷取工具會讀取套件目錄、進行驗證,並列出每個支援的媒體檔,方便您直接下載,無論是逐一下載,或是一次打包成單一 ZIP 取得完整的擷取結果。

how to export images from word document
how to export images from word document

為何截圖不等於原始圖片

當您使用作業系統的螢幕擷取功能取得圖片時,您拍下的是已渲染頁面的照片。Word 會依據所選的縮放比例、可見的頁面邊界以及目前的顯示裝置來渲染文件,而截圖只是單純記錄螢幕所顯示的內容。文件中的原始媒體檔可能比螢幕預覽大得多,可能帶有透明背景,也可能是螢幕擷取無法複製的無失真格式。

一旦圖片遭到截圖,便會出現幾項實際的副作用:

  • 解析度降低。一張寬度 3000 像素的照片,在 Word 中以 30% 的大小顯示時,仍保留 3000 像素的原始資料,但截圖只能捕捉到實際顯示的像素。
  • 透明度變成白色或灰色。以 PNG 為基礎的標誌與簽名會失去透明像素,並疊上頁面背後的內容。
  • 新增壓縮。您儲存的點陣圖會被螢幕擷取工具重新編碼,通常是 JPEG,這會在文字與邊緣處產生瑕疵。
  • 邊界與尺標悄悄混入。如果頁面邊界可見,圖片便會帶有一圈背景外框,必須另外裁切掉。

擷取原始資料能徹底跳過上述所有步驟。您儲存的檔案就是 Word 原封不動存放的檔案,位元層級完全一致,因此 PNG 仍是 PNG、JPEG 仍是 JPEG,任何 alpha 通道或色彩描述檔都能完整保存。

Word 實際上是把圖片存在 .docx 檔案的哪裡

每個現代的 Word 文件都是由 ECMA-376 所定義、以 ZIP 為基礎的 Office Open XML 套件。其資料夾結構遵循 Microsoft Open XML 參考文件所記載的慣例,而在該套件中,作者透過標準的「插入 > 圖片」流程所嵌入的每張圖片,都會被放入一個名為 word/media 的資料夾。該資料夾可同時存放多個相同格式的檔案,每個檔案都透過文件 XML 中的關聯來引用,記錄其在可見頁面中的大小、位置與文繞圖模式。

Word 直接寫入 word/media 的常見影像編碼包括:

  • PNG — 通常用於截圖、標誌、線條藝術,以及需要透明背景的影像
  • JPEG — 通常用於照片與大型掃描影像
  • GIF — 偶爾用於小型內嵌圖形
  • BMP 與 TIFF — 在舊版或掃描器軟體插入時偶爾會見到
  • EMF 與 WMF — Office 原生的中繼檔資料,部分舊版 Office 圖案仍會使用

凡是 Word 自行繪製、而非以圖片形式儲存的內容,都不會放在 word/media 中。SmartArt、原生圖表、方程式、文字方塊、圖案填色、頁面背景以及許多浮水印紋理,都是以文件 XML 描述或在渲染時即時產生,因此無法僅靠列出媒體資料夾就以獨立影像檔的形式取回。

從 Word 文件中取出每一張原始圖片

Extract Images from Word 工具遵循套件格式所允許的三步驟流程:選擇檔案、讀取媒體資料夾、再交還位元組資料。整個過程不需要上傳、不需要安裝 Office,也不需要在中間進行文件渲染。

  1. 在任何一款現代的桌面瀏覽器中,前往 /image/extract-images-from-word/ 開啟 Extract Images from Word 頁面。
  2. 點擊檔案選擇器,從您的裝置中挑選一份 .docx 的 Word 文件。
  3. 等待瀏覽器在本機讀取套件,並列出 word/media 中支援的影像項目;ZIP 函式庫只有在選定檔案後才會載入一次。
  4. 點擊任何單一圖片,即可原封不動地下載其原始檔案,或使用 ZIP 按鈕將所有取回的影像打包成單一封存檔,並使用安全且不重複的檔名。
  5. 保持原始 .docx 檔案不變,以便之後仍能在 Word 中開啟周圍的文字、格式與排版。

如果文件在 word/media 中沒有任何支援的項目,工具會明確回報,而不會假裝有圖片可匯出。

擷取工具能取回的內容 vs Word 自行繪製的內容

設定期望最清楚的方式,就是把 Word 中各類視覺物件與其在套件中的儲存方式、以及擷取工具的行為逐一比對。

Word 中的視覺元件是否以影像檔形式存在於 word/media?能否以獨立圖片形式取回?
從磁碟插入的照片是(PNG、JPEG 等)是,並保留原始格式與解析度
帶透明度的標誌與簽名通常為 PNG是,連同 alpha 通道一併保留
EMF/WMF 中繼檔資料是(前提是 Word 已將其儲存)原樣取回;能否開啟視接收端應用程式而定
以圖形形式插入的掃描頁面影像是(通常為 JPEG 或 PNG)
Word 繪圖、文字方塊、圖案填色否 — 由文件 XML 描述
SmartArt 圖形與原生圖表否 — 在渲染時即時產生
方程式與數學區塊否 — 由文件 XML 描述
頁面背景與浮水印紋理有時由 XML 描述,有時存於媒體僅在 word/media 中確實存在檔案時才能取回
外部連結的影像(URL 或 UNC 路徑)否 — 它們位於文件之外工具無法擷取

這個工具的任務是識別 word/media 中受支援的儲存媒體檔。它並非文件渲染器,也不會嘗試重建每張圖片在頁面上的位置、其裁切設定,或是被哪一段段落所環繞。

隱私、檔案安全性,以及哪些步驟保留在本機

整個擷取流程的每一步都在瀏覽器分頁中執行。.docx 套件在本機讀取,word/media 中的資料被複製到下載結果中,不會將文件的任何複本傳送到遠端伺服器。用於解封的 ZIP 函式庫,只有在選定檔案之後才會從網路載入,因此單純開啟頁面的使用者並不會載入該資源。

在擷取任何內容之前,工具會檢查套件目錄,並拒絕那些看起來不適合在瀏覽器端處理的輸入:

  • �損的封存檔會在最開始就被拒絕,而非等到稍後才觸發例外。
  • 不支援的 ZIP64 目錄紀錄超出了工具願意處理的實際範圍,因此不會開啟。
  • 宣告展開後體積過於不合理的封存檔會遭到拒絕,避免惡意套件藉由宣稱會膨脹成 PB 等級來耗盡瀏覽器記憶體。
  • 封存檔中的項目數量過多也會因為相同原因而被設定上限。

擷取結果中的檔名會經過處理以適合下載;若套件中包含重複檔名,則會保持名稱區隔,避免兩個 image1.png 在磁碟上互相靜默覆寫。

圖片的來源 vs Word 自行繪製的內容

Office 的封裝機制並不會將每個視覺物件都變成獨立的影像檔。Word 繪圖、SmartArt、圖表、方程式、文字方塊、圖案填色以及頁面背景,都可以由文件 XML 描述,或在渲染時即時產生,而非以圖片形式存放在 word/media 中。反過來的情況也可能發生:作者刪除可見引用後,仍可能有未使用的媒體元件留在套件中,因此擷取結果中可能出現一小批已不再顯示於頁面上的殘留圖形。

因此,這個工具識別的是支援的儲存媒體檔,而非每個頁面的完整視覺渲染。若要建立可靠的取回流程,建議下載檔案、保留一份未經修改的 .docx 複本,並在重複使用或刪除素材之前,先將擷取出的檔名與來源文件進行比對。

取得圖片之後可以怎麼處理

將原始檔案從文件中取出之後,通常只要再進行幾個簡單的後續步驟就能完成工作。從手機照片產生的大型 JPEG,可透過 Image Compressor 縮成更便於分享的大小;需要縮小容量的透明 PNG,則可透過 WebP Converter 轉為 WebP;至於一批取回的圖片,則可使用 Image to PDF 工具輕鬆組合成 PDF。

請將原始的 .docx 檔案保留為文件結構的唯一來源,並把擷取出的影像視為一份獨立、可重複使用的素材庫。

若您正在比較各種選項,Extract Original Images From Excel Without Uploading 一文對此有詳細說明。

若您正在比較各種選項,How to Extract a Picture from an Excel Header 一文對此有詳細說明。