線上 AI 文字清理工具會把大型語言模型留下的排版特徵 —— 長破折號、智慧引號、隱藏的 Unicode 字元、以及多餘的空白 —— 全部正規化,方法是透過瀏覽器在你貼上的草稿上執行六條可獨立切換的規則,無需上傳也無需帳號。AI Text Cleaner 就是專門為這項任務打造的:把 AI 的格式痕跡剝除,回到純鍵盤字元,但不會改寫你的措辭。像是 ChatGPT、Claude 和 Gemini 這類 AI 助理傾向使用長破折號作為句子分隔、用彎引號標示對白、以及使用 Unicode 省略號 (…) 取代三個普通的句點,這些選擇在複製貼上到你的文書處理器、CMS 或電子郵件用戶端後都會保留下來。一旦這份草稿進到稿件範本、純文字電子郵件,或是要求 ASCII 標點的 CMS 之中,AI 的格式就會被視為錯誤而非風格選擇。一個好的 AI 文字清理工具會把每個排版問題都視為獨立規則,這樣相同的文字輸出時,格式會被正規化為純鍵盤字元,而這六條規則是各自獨立的開關,而不是一個全有或全無的單一切換 —— 你可以單獨把引號改正而不動到破折號,或在保留段落間距完全不變的情況下剝除隱藏字元。

ai text cleaner online
ai text cleaner online

AI 助理在草稿中留下了什麼

一段來自聊天機器人、外觀乾淨的段落,在複製出聊天視窗後,可能帶著驚人數量的隱藏格式包袱。最顯眼的痕跡包括:被用來取代逗號或冒號的長破折號、包圍對白和縮寫的彎雙引號與彎單引號,以及用來取代三個普通句點的 Unicode 省略號 (U+2026)。這些字元本身都沒有錯,但在純文字電子郵件、要求 ASCII 標點的 CMS,或要求使用直引號與連字號的稿件風格指南中,看起來就格格不入。

較不易察覺的是藏在貼上內容中的隱藏字元:零寬度空格、字元接合符、位元組順序記號、軟連字號,以及決定一行文字是由左至右或由右至左閱讀的雙向控制字元。這些字元在每一次執行尋找與取代時都會存活下來,因為它們看起來完全和「什麼都沒有」一樣。AI 草稿也常常帶著慷慨的間距 —— 兩個字之間有兩個空格(你只打了一個)、每行結尾有尾端空白、以及本文上下都有空行 —— 因為這些模型是在已排版的網頁上訓練出來的,而不是在電子郵件友善的文字上訓練的。專門打造的線上 AI 文字清理工具會把這些問題分別視為可切換的獨立規則,讓你只修補需要修正的部分,其餘保持不動。

六條可切換的規則及其各自處理的對象

清理作業以六個獨立開關的形式執行。長破折號規則涵蓋看起來像句子標點的排版型破折號(U+2013 en dash、U+2014 em dash、U+2015 horizontal bar),並讓你選擇替換成什麼:連字號、逗號或單一空格。連續多個破折號會塌縮成單一替換,並修復破折號周圍的間距,確保你不會出現雙空格或在逗號前留下空格。引號規則會把 U+2018 到 U+201F 範圍內的所有彎引號,以及 prime 與 double-prime 符號,全部改為直式撇號與直式雙引號。省略號規則會把單一字元的 U+2026 替換為三個普通句點。隱藏字元規則會移除零寬度空格、字元接合符、位元組順序記號、軟連字號、組合用字素接合符、方向標記、隱藏的數學運算子,以及兩種隱藏式浮水印載體(Unicode Tags 區塊以及表情符號相關保留之外的補充變體選擇器)。間距規則會把兩個以上連續的空格或定位字元塌縮為一個,並修剪每行結尾的尾端空白。空行規則則會在段落之間最多保留一行空行,並移除文字最開頭與最結尾的空行。

規則 處理對象 產生結果
破折號 U+2013 en dash、U+2014 em dash、U+2015 horizontal bar 連字號、逗號或單一空格(由你選擇)
引號 U+2018–U+201F 彎引號、prime、double prime 直式 ' 與 "
省略號 U+2026 單字元省略號 三個句點
隱藏字元 零寬度空格、字元接合符、BOM、軟連字號、方向標記、Tags 區塊、補充變體選擇器 完全移除
間距 連續 2 個以上的空格或定位字元;尾端空白 單一空格;行尾不留任何空白
空行 段落之間的多個空行;開頭與結尾的空白 段落之間最多一個空行

長破折號規則另外涵蓋三個與普通連字號視覺上完全相同的字元 —— U+2010 hyphen、U+2011 non-breaking hyphen,以及 U+2012 figure dash —— 並一律把它們轉為單一鍵盤連字號,無論你為真正的句子破折號選擇了哪種替換方式。原因很簡單:把 left-to-right 中的連字號改成逗號會破壞單字,而不是清理它。另一個獨立決策適用於減號 U+2212,它會保持原樣,因為它是數學運算子,改寫它會改變數字的含義。

如何在瀏覽器中清理 AI 文字

  1. 把 AI 生成的文字貼到方框中,或選擇「載入範例」來看一個典型例子。
  2. 勾選你想要的規則,並選擇破折號要變成連字號、逗號還是空格。
  3. 選擇「清理文字」,檢查各規則的變更次數,然後複製清理後的結果。

每一條規則都會回報它在該次執行中變更的字元數,因此總數會與輸出完全對應,而不是猜測究竟改了多少。輸入中的每一種行分隔符 —— Windows 歸位字元、PDF 與 InDesign 匯出的 U+2028 與 U+2029 分隔符,以及網路聊天常見的普通換行 —— 都會先摺疊為 LF,因此間距與空行規則無論草稿來自何處都能有一致表現,且輸出永遠使用 LF 行結尾。整個作業都在你的瀏覽器中執行:文字從不上傳、從不儲存、從不送往 API,也從不綁定任何帳號,這在你清理的草稿屬於客戶文案或未公開作品時格外重要。輸入上限為一百萬個字元,因此大型貼上不會讓分頁當機。

清理工具刻意保留的字元

並非每個看起來隱形的字元都是垃圾。有三類是刻意保留的,因為移除它們會損壞有效文字,而非清理它。零寬度接合符會把多人表情符號序列黏合成單一字素叢集 —— 把它移除,家庭表情符號或職業加膚色的表情符號就會拆散成並排顯示的個別字元,而不是接合在一起。零寬度非接合符在波斯文、阿拉伯文以及數種印度系文字中是文法上必要的,它能防止應當分開的字母之間發生草書連寫。變體選擇器 U+FE00 到 U+FE0F 包含變體選擇器 16(U+FE0F),這個字元能把像是 U+2764(實心黑心)這樣的 Unicode 碼位從黑白字形翻轉為全彩表情符號;移除它會默默把你的表情符號降級回文字。

另外還有兩個字元因不同理由而被保留。法式引號(「 和 」)以及 CJK 括號對「「」」保持原樣,因為改寫它們會破壞合法的法文、俄文或 CJK 引文標記,而不是去除 AI 痕跡。減號 U+2212 保持為減號,因為它是數學運算子,把像是 "−3" 這樣的試算表貼上內容改成 ",3" 會改變數字的含義。

隱藏字元藏在貼上的 AI 草稿中的哪些地方

在貼上的 AI 輸出中,隱藏字元規則是最重要的一條,而它移除的字元並非單一類別。它會剝除零寬度空格 (U+200B)、字元接合符 (U+2060)、位元組順序記號 (U+FEFF)、軟連字號 (U+00AD)、組合用字素接合符 (U+034F)、由左至右與由右至左標記 (U+200E 與 U+200F),以及隱藏的數學運算子 (U+2061 到 U+2064)。它也會移除兩種已出現在已發表 AI 文字浮水印研究中的隱藏式浮水印載體:Unicode Tags 區塊 (U+E0001 到 U+E007F),以及 U+FE0F 之後的補充變體選擇器。在這些之後還有 Trojan Source 漏洞類別 —— 雙向嵌入、覆寫與隔離字元 (U+202A 到 U+202E 以及 U+2066 到 U+2069) —— 它們是隱形的、能在複製貼上後存活,並能在檢視者使用錯誤的文字方向時,重新排序一行的呈現方式。每個等寬與不斷行空格都會被轉為普通空格,這很重要,因為尋找與取代、字數計算器和閱讀時間估算器都以普通空格字元為基準;如果你的草稿充滿不斷行空格,字數會悄悄偏移,你的正規表示式也會比對不到。列表中的每一個碼位都已依據 Unicode Character Database 進行核對,並交叉比對第二個權威來源,確保該規則不會過度延伸到具有意義的字元。

何時該清理,以及這個工具不做什麼

線上 AI 文字清理工具是排版工具,不是寫作工具。它不會改寫句子、換句話說、翻譯或潤飾風格,也不主張清理後的文字一定能通過任何 AI 偵測器 —— 那些是不同的問題,需要不同的解法。當你想要相同的文字但格式正規化為純鍵盤字元時使用它,在把草稿貼進 CMS、稿件範本、純文字電子郵件或程式碼註解之前。在你其實希望保留彎引號、長破折號或接合符時跳過它 —— 例如遵循自家風格的已出版小說、引號應為法式引號的法文文件,或是仰賴表情符號序列正確呈現的社群貼文。由於每條規則都是獨立開關,且每次變更都有計數,你可以先開啟所有規則跑一次,看看草稿裡藏了什麼,再關掉會損壞合法內容的規則,重跑一次。

如果你正在權衡選項,How to Format Text in a LinkedIn Post Before Pasting 對此有詳細說明。

如果你正在權衡選項,Clean AI Text for Free in Three Steps 對此有詳細說明。