跳至主要內容
Lizely

文字檔分割工具

依可預期的行數把一個本機文字檔分成多個部分,逐一下載 UTF-8 分段,全程不上傳來源檔。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.選擇一個不超過 10 MiB 的 TXT、CSV、MD 或 LOG 檔。
  2. 2.輸入每一部分應包含的整數行數。
  3. 3.分割檔案、確認總行數與部分數量,再下載每一個編號的 TXT 分段。

關於文字檔分割工具

文字檔分割工具會把一個本機純文字檔依所選的每份最大行數切成連續部分。選擇最大 10 MiB 的 TXT、CSV、MD 或 LOG 檔,輸入 1 至 100,000 的整數,執行分割後即可逐一下載各部分。瀏覽器會在本機讀取與處理檔案,不會把任何位元組上傳到 Lizely。

工具會把 CRLF、單獨 CR 與 LF 辨識為行邊界,且 CRLF 只算一個邊界。產生的分段會以 LF 連接各行,因此混合的輸入行尾會在輸出內統一;每行的其他字元內容則完全保留,包括縮排、尾端空格、標點與 Unicode 文字。

末尾的行邊界會建立最後一個空白行。例如只含字母 a 後接 LF 的檔案,在文件規則下有兩個邏輯行;若每份設為一行,可能產生一個空白的最後部分。這項明確處理可避免工具無聲丟棄來源邊界。空檔案會被拒絕,因為沒有可分割的有效內容。

分割會從第一行依序進行。除了最後一份包含餘數外,每個完整部分都含有所選行數。工具不會重新平衡各份大小、不會依位元組或字詞分割、不會偵測段落,也不會讓含有引號內嵌換行的 CSV 紀錄保持完整;這是一項純粹的逐行操作。

原始基本檔名會保留,後面加上 part 與三位數序號,例如 notes-part-001.txt 與 notes-part-002.txt。產生的副檔名一律是 TXT,因為輸出是 UTF-8 純文字 Blob;原始 CSV 或 Markdown 副檔名不會保留,以免暗示每個分段仍是獨立有效的該格式檔案。

接受的副檔名是 TXT、CSV、MD 與 LOG,但工具不會驗證其語法或來源編碼。瀏覽器的 File.text 會把位元組解碼為 UTF-8;非 UTF-8 檔或以可接受副檔名偽裝的二進位檔,解碼後可能出現替代字元。請在目的地應用程式中檢查代表性輸出。

10 MiB 上限用來約束解碼與渲染。每份行數必須是 1 至 100,000 的整數;小數、零、負數與更大數值都會被拒絕。工具會先驗證限制再產生分段,無效輸入不會得到部分結果。

每個下載按鈕只會在點選時建立暫時物件 URL、觸發一次檔案下載,然後立即撤銷;渲染期間不會建立長期物件 URL。選擇另一個檔案或變更每份行數時,舊結果會被清除,避免把舊檔名與統計誤認為目前設定。

本工具適合把可管理的清單、紀錄、字幕式資料列、簡單匯出內容或文字語料分成較小批次。它不會建立 ZIP,因為沒有引入新的相依套件;每個分段都需個別下載。要求大量分段時,瀏覽器可能會詢問是否允許多檔下載。

CSV 與結構化格式需要特別留意。合法的帶引號 CSV 欄位可以包含換行,直接在該邊界分割可能產生無效片段;JSON、XML、原始碼與 Markdown 結構也可能跨行。結構有效性重要時,請改用理解該格式的解析器。

原始檔案永遠不會被修改。請保留來源,直到所需分段都已下載並檢查。相同的解碼輸入與行數設定必定產生相同字串、總行數、分段數與補零檔名;沒有伺服器儲存、帳戶或保留的處理紀錄。

方法與來源

驗證一個副檔名可接受且不超過 10 MiB 的文字檔,在本機解碼為 UTF-8;驗證 1 至 100,000 的整數分段行數;先切分 CRLF,再切分單獨 CR 或 LF,並保留末尾空白邏輯行;依序切片且不重新平衡,以 LF 連接每一份,產生補零的部分檔名,只在各下載按鈕點選時建立並撤銷暫時 Blob URL。

常見問題

同時支援 CRLF 與 LF 嗎?
是。CRLF、單獨 CR 與 LF 都能辨識,產生的分段邊界會使用 LF。
為什麼末尾換行可能建立空白的最後一行?
依文件中的計數規則,每一個末尾邊界都會開始最後一個邏輯行。
CSV 紀錄會保持完整嗎?
不會。分割以行為單位,不會解析帶引號的多行 CSV 欄位。
來源檔會被上傳嗎?
不會。檔案讀取、分割與下載都在瀏覽器本機完成。

文字工具 使用指南

查看全部