在 Windows 上,您可以使用 Text File Splitter 將文字檔案分割成每 N 行一個的可預測區塊,這是一個瀏覽器工具,可在本地讀取檔案、依序將其分割成 1 到 100,000 行的整數區塊,並在 10 MiB 檔案大小上限內,將每個編號的部分作為獨立的 TXT 檔下載。原始檔案絕不會離開您的電腦:解碼、切割以及暫存下載連結全部都在用戶端執行,因此相同的輸入結合相同的區塊大小,每次執行分割時都會產生相同的字串、相同的行數總計、相同的部分數量,以及相同的零填補檔案名稱。這個操作嚴格以行為導向,CRLF、單獨的 CR 以及 LF 都會被識別為行邊界,且 CRLF 會被計算為一個而非兩個。在每個產生的部分中,行與行之間以 LF 連接,因此混合 CRLF 和 LF 結尾的 Windows 檔案,在輸出內容中會變得一致。結尾的行邊界總是會開始一個最終的邏輯行,這就是為什麼一個後面接著換行符的單一字元檔案,在文件化的計數規則下會有兩行,並且當區塊大小為一時,可能會產生一個空白的最終部分。
原始的基底檔案名稱會被保留,並與「-part-」加上三位數的序號結合,例如 notes-part-001.txt 和 notes-part-002.txt,無論原始檔案叫什麼名稱,產生的副檔名一律為 TXT。由於切割是從第一行開始向前進行,除了最後一個部分包含剩餘的行之外,每個完整的群組都包含所要求的行數,且在任何階段都不會進行重新平衡、按位元組大小分割或段落偵測。

為什麼瀏覽器分割工具在 Windows 上運作良好
在 Windows 上有幾個內建和第三方的選項可用來分割文字檔案。PowerShell 的 Get-Content 搭配計數器和寫入器可以切割檔案,但迴圈、檔案命名以及編碼處理都得由您自己來。Notepad++ 對於非常大的檔案有內建的分割行為,但它操作的是檢視狀態,而非產生乾淨的、以行為基礎的匯出。GSplit 或 HJSplit 等可安裝的公用程式可以按位元組數分割檔案,但每一個都會引入另一個您必須信任其資料處理的程式,還得學習如何使用它。對於希望根據乾淨的行數來取得各部分的純文字檔案,基於瀏覽器的方法免除了安裝程式、登錄項目以及更新週期:開啟頁面、選擇檔案、輸入區塊大小,然後下載。
Text File Splitter 正是圍繞這個理念所建構。整個流程都在瀏覽器中執行,來源檔案會以 File.text 作為 UTF-8 進行解碼,而各區塊會透過暫存的 Blob URL 一次一個地交付,頁面會在每次點擊後立即撤銷這些 URL。在 Windows 10 或 11 上不需要管理員權限、不需要套件管理工具,也不需要特定的瀏覽器版本。
在 Windows 中逐步分割文字檔案
在存放檔案的 Windows 電腦上,使用 Edge、Chrome、Firefox 或任何現代瀏覽器開啟 Text File Splitter,然後依照下列順序操作。
- 點擊檔案輸入欄位,選擇一個不超過 10 MiB 的本地 TXT、CSV、MD 或 LOG 檔案。超出該上限的檔案會在任何解碼工作開始之前就被拒絕,空檔案也會因相同原因被拒絕。
- 將每個部分的最大行數輸入為介於 1 到 100,000 之間的整數。小數、零、負數以及超過 100,000 的值會在任何區塊產生前被拒絕。
- 點擊 Split 按鈕,並等待工具回報總行數和部分數量。由於切割是從第一行開始向前進行,除了最後一個部分包含剩餘的行之外,每個完整的群組都包含所要求的行數。
- 將回報的行數總計與您預期從原始檔案得到的結果進行比較。對於一個 500 行的檔案,若區塊大小為 100,則結果恰好是 500 ÷ 100 = 5 個部分,每個部分 100 行。對於不能整除的檔案,最後一個部分會較短,並包含剩餘的行。
- 依序點擊每個編號的下載按鈕以儲存其 TXT 部分。當要求下載許多部分時,瀏覽器可能會要求多次下載的權限。
- 請保留原始檔案,直到所有部分都已下載並在使用該資料的應用程式中確認完成,因為分割工具絕不會修改來源檔案。
工具內部的行數計算方式
行數計算規則之所以明確,是因為 Windows 文字檔案經常會將 CRLF 與較舊的 LF 內容混合使用。CRLF、單獨的 CR 以及 LF 各自都會被視為行邊界,且 CRLF 計算為一個邊界。輸出區塊對每個換行符都使用 LF,因此混合結尾的來源檔案在部分內會變得一致。
結尾的行邊界會開始一個最終的邏輯行,這是最常見的「差一」錯誤來源。一個包含字母 a 後接單一換行符的檔案,在文件化的計數規則下會有兩行,並且當區塊大小為一時,可能會產生一個空白的最終部分。每行內部的縮排、結尾空白、標點符號以及 Unicode 字元都會被完整保留。該工具不會重新平衡、不會按位元組、不會按單詞分割、不會偵測段落,也不會將 CSV 記錄保持在一起;整個操作從頭到尾都是純粹以行為導向。
需要特別注意的檔案類型
該工具不會驗證您指向的檔案的語法或來源編碼。可接受的副檔名是 TXT、CSV、MD 和 LOG,但分割工具不會解析其中任何一種的結構。帶引號的 CSV 欄位可以合法地包含換行符,而在該邊界進行分割可能會產生無法透過 CSV 解析器往返處理的片段。JSON、XML、原始碼以及 Markdown 結構也可能跨越多行,因此按固定行數切割可能會中斷標題、圍欄程式碼區塊或表格。
如果檔案實際上不是 UTF-8,File.text 解碼可能會在輸出中產生替換字元 (replacement characters),這在以 CP-1252 或其他舊編碼由較舊的 Windows 工具所儲存的檔案中較為常見。在刪除來源檔案之前,請務必在目標應用程式中預覽一個具有代表性的部分。對於區塊大小為行數總計一半的特定對半分切工作流程,有關 如何按行數將文字檔案對半分切 的專屬指南詳細說明了該計算過程。
限制、檔案名稱以及下載內容
互動介面很小,因此值得預先了解其限制:
| 設定 | 可接受的值 |
|---|---|
| 檔案大小上限 | 10 MiB (10,485,760 位元組) |
| 可接受的副檔名 | TXT, CSV, MD, LOG |
| 每部分的行數 | 1 到 100,000 之間的整數 |
| 可識別的行結尾 | CRLF、單獨的 CR、LF |
| 輸出中的行結尾 | 僅 LF |
| 輸出副檔名 | TXT,永遠為 UTF-8 |
| 檔案名稱模式 | basefilename-part-XXX.txt |
| 封裝歸檔 | 無;每個部分單獨下載 |
| 處理位置 | 瀏覽器,僅本地;不上傳 |
支援每次下載的 Blob URL 是在點擊時建立,並在瀏覽器交出檔案後立即撤銷,因此在各次點擊之間,不會有長期存在的物件 URL 留在記憶體中。選擇另一個檔案或變更區塊大小會清除先前的結果,因此舊的檔案名稱和計數不會被誤認為新設定的結果。沒有伺服器儲存空間、無需帳號,也不保留處理紀錄;分頁一旦關閉,分割部分的唯一副本就是您下載的那一份。
在 Windows 上驗證並重新合併各部分
最快速的健全性檢查是確認工具回報的行數總計與目標應用程式開啟來源時所看到的相符。該工具會在分割後回報總行數和部分數量,由於除了最終的剩餘部分之外,每個完整的群組都是所要求的大小,因此可以根據行數總計預測部分數量。除了 LF 正規化之外,每個部分都會精確保留其字元,因此在 Windows 上重新合併它們很簡單:在 PowerShell 中,依序將編號部分的內容透過管道傳送給 Set-Content,或在 Notepad++ 中依序開啟它們。除了每個部分內部一致的 LF 結尾之外,預期結果與來源檔案在位元組層級上完全相同。
對於超過 10 MiB 的檔案,分割工具會預先拒絕它們,而不會產生部分結果。分割較大的檔案意味著必須分兩次或多次進行,並手動保持各部分計數的正確性,或者使用其他公用程式預先修剪該檔案。如果檔案中的行需要在分割之前或之後進行額外的清理,例如移除重複項目、排序或去除空白字元,那些都是單獨的操作:分割工具不會編輯任何一行的字元內容。