跳至主要內容
Lizely

文字排序工具

以穩定英文定序、自然數字順序、精確重複移除與明確清理控制,排序最多 50,000 行。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.貼上要排序的逐行文字。
  2. 2.選擇方向、英文大小寫與數字比較,再只開啟需要的清理控制。
  3. 3.排序各行、確認前後計數與精確預覽,再下載 TXT。

關於文字排序工具

文字排序工具會依一組有文件記載且彼此獨立的控制項排列純文字行。貼上最多 1,000,000 個 UTF-16 程式碼單元與 50,000 個邏輯行,選擇遞增或遞減、比較是否區分英文大小寫與考慮數字,並可選擇修剪、移除空白行或移除完全重複。完整結果可預覽與下載為 UTF-8 文字,任何內容都不會上傳到 Lizely。

工具辨識 CRLF、單獨 CR 與 LF 行邊界,並在排序結果中以 LF 連接。混合輸入行尾因此會統一,而每個保留行的字元內容除非明確選擇修剪,否則保持不變。預覽中的視覺換行絕不建立額外邏輯行。

比較使用瀏覽器英文 Intl.Collator。關閉英文大小寫區分時,只有大小寫不同的字母會比較為等值。排序保持穩定,因此等值行仍維持原始相對順序;開啟後,大小寫會參與定序。這是語言式瀏覽器定序,不是原始 Unicode 碼位或位元組排序。

自然數字順序會讓數字片段依數值比較,例如 file2 排在 file10 前面。關閉後,兩者依同一 collator 當成一般文字比較。自然排序適合檔名與編號標籤,但不會把小數、日期、版本、單位或帶符號數學式解析成結構化資料。

遞增依 collator 從低到高排列;遞減反轉比較結果,同時對等值維持穩定順序。它不是單純反轉最後的遞增陣列,因為那也會反轉等值項目,違反穩定性規則。

「修剪每一行」會在其他清理與排序前移除行首尾 Unicode 空白,但不合併行內空格。「移除空白行」在可選修剪後執行,所以只含空白的行只有在兩個相關控制項都需要時才會變空並移除;未修剪時,含空格的行不算空白行。

「移除完全相同的重複行」也在可選修剪與空白行移除後、排序前執行。完全相同指 JavaScript 字串相等;即使不區分大小寫比較把 Apple 與 apple 視為等值,兩者仍分別保留。第一筆保留,後續完全相同副本移除;不使用模糊比對或 Unicode 正規化。

結果回報原始邏輯行數與最後行數。差異來自空白行或完全重複移除,不是排序本身。變更任何輸入或選項會立即清除舊輸出,避免先前計數與新設定混淆。

可用於字詞清單、檔名、標籤、簡單庫存值、測試資料、複製的表格欄與逐行筆記。它不了解 CSV;CSV 記錄可含帶引號換行,排序個別實體行可能破壞記錄結構。引號、標題列或多欄重要時,請使用理解格式的表格工具。

定序可能不同於資料庫 ORDER BY、作業系統檔名順序、試算表 locale 設定或其他程式語言。若排序輸出要成為契約或可重現機器產物,請確認英文瀏覽器定序與所選數字、大小寫選項符合目的地系統。

1,000,000 字元與 50,000 行限制可約束切分、附索引穩定排序、預覽渲染與 Blob 建立。超過上限的輸入會在排序前拒絕,不回傳部分輸出;剛好等於文件限制可接受。

下載只在點選後建立暫時 UTF-8 Blob URL,並在瀏覽器開始傳輸後排定立即撤銷。操作不使用遠端服務、外部資料集、亂數輸入或帳戶歷史。相同有效文字、瀏覽器定序實作與選項會產生相同行序。

方法與來源

拒絕格式錯誤的 UTF-16 代理序列;驗證非空輸入不超過 1,000,000 個 UTF-16 程式碼單元;先切分 CRLF,再切分單獨 CR 或 LF,並拒絕超過 50,000 行;可選修剪各行、移除結果空白行與只保留第一筆完全重複;以目前索引裝飾剩餘行,使用針對明確大小寫與數字行為設定的英文 Intl.Collator 比較,套用遞增或遞減並以索引作穩定 tie breaker;以 LF 連接,並在點選下載時建立短期 UTF-8 Blob URL。

常見問題

數字順序會讓 item2 排在 item10 前面嗎?
開啟自然數字順序時會;關閉時兩者當成一般文字比較。
移除重複會忽略英文大小寫嗎?
不會。它只在可選修剪後移除完全相同的字串。
支援 Windows 行尾嗎?
支援。CRLF、CR 與 LF 都能辨識,產生輸出使用 LF。
文字會上傳嗎?
不會。清理、排序、預覽與下載建立都在本機完成。

文字工具 使用指南

查看全部