Outlook 郵件資料夾會保留你曾經往來之每位寄件者、回覆與 CC 地址的完整歷史,這使得它們成為聯絡人清單最自然的來源。若要從 Outlook 的郵件資料夾中擷取電子郵件地址,請複製該資料夾的訊息內容,將其貼到本機瀏覽器型的擷取工具中,再讓一個實用的 ASCII 電子郵件樣式從中抽取去重後的清單。整個流程在瀏覽器中只需三個動作:貼上文字、選擇輸出順序,然後按一下「Extract」。由於掃描是針對文字區域中已有的字元進行,不會有任何資料離開這個分頁,你也不需要開啟底層的 PST 或 OST 檔案就能開始。去重機制不區分大小寫,因此大小寫的變體會合併為單一筆,並保留第一次出現的拼法。本文的其餘部分將說明從 Outlook 複製的步驟、擷取的過程、工具所使用的規則(讓結果清單保持可信賴),以及當資料夾異常龐大時你必須留意的限制。

將郵件資料夾內容從 Outlook 取出
在任何擷取工具能夠執行工作之前,這些地址必須以工具可讀的形式離開 Outlook。Outlook 並未針對整個郵件資料夾提供「複製地址」的按鈕,因此最實用的方法就是複製訊息本身的文字,再讓擷取工具從這些文字中抽出地址。最快的途徑是使用內建的清單檢視,它會移除格式,並將每則訊息顯示為單一文字列,這是最乾淨的貼上目標。
- 開啟你想要擷取的郵件資料夾,切換到 View 索引標籤。選擇 Change View > Message List(或按 Ctrl+Shift+Tab 直到清單檢視生效為止)。
- 在資料夾中按 Ctrl+A 選取所有可見的訊息,然後按 Ctrl+C 複製。Outlook 會將寄件者名稱、主旨與日期以純文字形式放到剪貼簿。
- 將該選取內容直接貼到擷取工具的文字區域中。較長的選取內容可能會包含尾端空白,以及 Outlook 在欄位之間插入的定位字元;請保留它們原樣,因為擷取工具會忽略周圍的標點,但會將每個字元計入輸入預算。
- 若單一資料夾超出擷取工具的 500,000 字元輸入上限,請分批處理:依日期或寄件者排序資料夾、複製其中一個區段、貼上、執行 Extract、複製結果,然後重複。每次成功執行會取代先前的清單,因此請在開始下一批之前先儲存或貼上每一批的結果。
如果你只需要單一訊息的參與者,請開啟該訊息,按 Ctrl+A 選取內文,再按 Ctrl+C。若是整個對話串,請開啟對話,使用 Ctrl+Shift+Plus 展開每則收合的訊息,全部選取後再複製。擷取工具只在意被貼上的文字,而不在意它來自 Outlook 的哪個物件,因此複製步驟不需要任何特殊的外掛程式或巨集。
三個步驟擷取地址
Email Extractor 工具圍繞三個動作所設計:貼上、選擇、擷取。其他一切(驗證、去重、排序、剪貼簿步驟)都會在目前瀏覽器分頁中以這三個動作的結果自動發生,被貼上的文字不會被上傳。
- 將 Outlook 的文字貼到文字區域,並確認顯示的字元計數在 500,000 字元的輸入上限以內。超過該上限時,計數器會標示為超出上限的值,下一次 Extract 呼叫會在不處理文字的情況下回傳錯誤,因此絕不會顯示部分結果。
- 選擇一種輸出順序。First appearance 會保留工具遇到每個地址的順序,當目標是依時間排序的聯絡人清單時相當實用。A–Z 會以小寫 ASCII 鍵值排序,當目標是目錄或快速以視覺掃描重複項目時相當實用。無論選擇哪一個選項,都會清除先前的清單、錯誤與複製狀態,因此畫面絕不會顯示與目前文字不再相符的結果。
- 選擇 Extract emails。工具首先會以一個支援 Unicode 的寬鬆掃描找出形似郵件地址的符記,再套用下一節所描述的實用驗證器。執行成功時,結果區會顯示唯一、重複與遭拒的計數,並以每行一個地址的方式列出。執行失敗時,會先清除舊的結果再回報問題,因此先前的清單不會殘留在畫面上,看似仍符合目前的文字。
若要快速示範,請將以下短區塊貼到文字區域中:
From: [email protected] — please reply. CC: [email protected] (legal). See https://[email protected]/secret and mailto:[email protected].
以 First appearance 順序執行 Extract。驗證器會抽出兩個候選項目:[email protected] 與 [email protected]。第二個 [email protected] 會計入重複計數,而不是另列為一行。URL 內部的 [email protected] 會被拒絕,因為位於 HTTP、HTTPS 或 FTP URL 之內、形似郵件地址的 userinfo 區段不會被當作聯絡地址回報。mailto: 地址仍會被擷取,因為其用途明確就是電子郵件目的地。執行完成後,結果會顯示 2 個唯一、1 個重複與 1 個遭拒,這些資訊都會顯示在計數面板中。
符合與遭拒的輸入
擷取工具只辨識一般網路地址所使用、刻意精簡的 ASCII 格式:本機部分允許字母、數字、點、底線、百分號、加號與連字號;一個 at 符號;以及一個至少含兩個標籤的 DNS 風格網域。它並非完整的 RFC 5322 剖析器,因此有少數實際合法的格式會被刻意略過,而且被擷取出來的字串並不能證明該郵件信箱存在或可收信。常見的周圍散文標點不會被納入:逗號、分號、右括號、引號、驚嘆號及類似的分隔符號會停止掃描;而句尾的句號或省略號會在驗證前先被移除。
| 輸入樣式 | 範例 | 結果 |
|---|---|---|
| 乾淨的寄件者或 reply-to | [email protected] | 已擷取 |
| 先前匹配項的大小寫重複 | 在 [email protected] 之後出現的 [email protected] | 計為重複;保留第一次出現的拼法 |
| mailto: 連結 | mailto:[email protected] | 已擷取 |
| HTTP、HTTPS 或 FTP URL 內部的 userinfo | https://[email protected]/private | 遭拒 |
| 本機部分含有連續點 | [email protected] | 遭拒 |
| 網域標籤以連字號開頭或結尾 | [email protected]、[email protected] | 遭拒 |
| 單一標籤的主機 | alice@example | 遭拒 |
| Unicode 或國際化格式 | ü[email protected]、[email protected] | 遭拒 |
| 加引號的本機部分 | "alice team"@example.com | 遭拒 |
| 候選項目總長超過 254 字元 | 很長的本機部分 + 網域 | 遭拒 |
這些規則的目的在於阻擋最常見的誤判,例如 [email protected]、[email protected]、[email protected]、[email protected]、單一標籤的主機,以及只有一個字母的結尾標籤。同樣的目的也是為什麼本機部分的檢查不允許點位於開頭或結尾,也不允許連續點,且本機部分上限為 64 個 ASCII 字元。網域標籤遵循 RFC 1035 §2.3.1 中所描述的慣用名稱語法:字母、數字與位於中間的連字號,並具有明確的非空規則。依據工具的實用原則,最後一個標籤必須包含 2–63 個 ASCII 字母,這能抓出多餘的尾端標點與字母過少的結尾標籤。相同的慣例大致上也支撐著網頁上電子郵件輸入樣式的運作,相關說明請參閱 MDN 的電子郵件輸入驗證參考。
在大型郵箱資料夾中會遇到的限制
一個很長的 Outlook 資料夾可能會輕易超出擷取工具的輸入預算,而擁有數百位獨特參與者的冗長討論串則可能會超出結果預算。這兩個上限都會被明確強制執行,因此工具絕不會不會悄悄交回一份不完整的清單。下表列出從郵件資料夾擷取時最可能遇到的限制。
| 限制 | 數值 | 達到限制時的行為 |
|---|---|---|
| 輸入字元數 | 500,000 個 JavaScript 字元 | 計數器標示為超出上限;Extract 在不處理輸入的情況下回傳錯誤。 |
| 結果中的唯一地址數 | 1,000 | Extract 回傳錯誤,且不會給出部分的前一千筆清單。 |
| 本機部分長度 | 64 個 ASCII 字元 | 超過此長度的候選項目會被拒絕。 |
| 完整候選項目長度 | 254 個字元 | 超過此長度的候選項目會被拒絕。 |
| 結尾網域標籤 | 2–63 個 ASCII 字母 | 超出此範圍的候選項目會被拒絕。 |
剪貼簿步驟也有明確的行為。Copy all 會以非同步方式使用瀏覽器的剪貼簿,且僅會回報目前這份結果的複製是否成功;編輯輸入或離開頁面,會讓進行中的複製狀態更新失效。若剪貼簿權限不可用,輸出仍可供手動選取複製,因此地址清單絕不會僅因權限提示而遺失。同樣的瀏覽器本機處理機制也是工具不會擷取連結、檢查網頁、追蹤重新導向、查詢 DNS、測試 SMTP 伺服器或傳送驗證訊息的原因;它只分析文字區域中已有的字元,因此整個工作流程既快速又私密。
Clean and Use the Address List Safely
Once the result list is in hand, the right next step depends on the goal. For a quick contact import, paste the newline-separated result into Excel, a CSV column, or your CRM's bulk-add field. Outlook itself can accept a CSV file through File > Open & Export > Import/Export > Import from another program or file > Comma Separated Values; if the goal is to round-trip the addresses back into Outlook, export the extractor output as a CSV with a header named Email Address first, then run the wizard with the Do not import duplicate items option checked.
For one-off verification, treat the address list as a starting point, not a finished record. The tool only recognizes a documented practical character pattern, and it does not query DNS, connect to a mail server, or send a verification message, so pattern matching and mailbox validity are different things. If you also work with Gmail, the same extraction workflow applies after copying message content from Gmail; the practical guide at How to Extract Email Addresses From Gmail Messages walks through that side in detail. The two flows share the same extractor rules, so the table of matched and rejected inputs applies unchanged.
Finally, treat the result list as a candidate set, not a permission slip. Extraction does not grant the right to contact someone, confirm ownership of a mailbox, identify role accounts, distinguish disposable addresses, or detect typographical domains. Before sending anything, review consent, privacy obligations, suppression lists, jurisdictional requirements, and the source of every address. For high-stakes account creation or deliverability work, combine the extractor with confirmation emails, DNS checks, bounce handling, and human review rather than treating a pattern match as verification.
For a deeper look, see Extract Numbers from Text With Switchable Rules.