一個免費、不需註冊的字元碼查詢工具,完全在您的瀏覽器內執行:貼上任何字串,就能取得每個字元精確的 U+ 碼點,無需建立帳號即可離開。Unicode 編碼 / 解碼工具正是提供這樣的功能,可將文字轉換為大寫的 U+ 十六進位標記,或從這些相同的標記重建文字,全程都在您的機器上完成。內容不會傳送到伺服器,除了您本機的副本外也不會儲存任何資料,而且沒有任何註冊步驟擋在您與答案之間。每次轉換都保持在本地,這點很重要,因為人們貼到字元碼查詢工具中的字串經常是敏感的:密碼片段、內部識別碼、客戶資料,或包含未預期 Unicode 的檔名。您可以選擇編碼模式來檢視,選擇解碼模式來重建,而工具會將補充字元視為單一純量值,而不是將其拆成 UTF-16 代理對的兩半。

免費、不需註冊的字元碼查詢工具會回傳什麼
「免費不需註冊」這個詞同時描述了三件事:免費、無帳號、無需安裝。符合這個標準的查詢工具能在瀏覽器分頁中開啟,接受貼上的文字,並在同一個畫面上產生結果,輸入與輸出都不會離開裝置。這就是 Unicode 編碼 / 解碼工具背後的承諾。沒有登入表單、沒有試用倒數、沒有付費方案把您真正需要的功能鎖住,也沒有會要求寫入您檔案系統權限的安裝步驟。
實際上的意義是,這個工具能配合您發現問題的當下。您從記錄檔中複製一個奇怪的符號,將它貼到查詢工具中,看到 U+ 序列,再決定下一步怎麼做。如果同事在聊天訊息中傳了一個像 U+1F4A9 或 \u{1F600} 的標記給您,您就把標記貼到解碼模式,讀出他們想表達的意思。問題與答案之間完全沒有摩擦,這就是查詢碼點而不自己寫腳本的核心價值。
為何查詢工具在瀏覽器本地執行
本地處理才能讓「不需註冊」是真實的,而非行銷話術。轉換過程會逐一處理 Unicode 純量值,並將每個值格式化為大寫、至少四位數的 U+ 十六進位標籤;解碼模式則會在呼叫平台碼點建構函式之前,先驗證純量範圍並排除代理字元。這整個過程都不需要後端來回溝通,所以瀏覽器能直接在頁面上完成。
把工作保留在本地,同時也保護您所貼上的內容。碼點檢查經常發生在不該外傳的文字上:API 金鑰、內部代稱、帶有組合記號的客戶姓名,或包含零寬連接字元而在磁碟上無法匹配的檔名。伺服器端的工具必須承諾會刪除您的輸入,而這項承諾很難驗證。瀏覽器端的工具則不需要任何承諾,因為位元組從未離開分頁。
三步驟查詢字元碼
- 選擇「文字轉碼點」方向,貼上您想檢視的精確字串,包括空格、Tab 或零寬連接字元等不可見字元。
- 轉換並閱讀出現的 U+ 序列;基本字元會顯示至少四位十六進位數,補充字元則保持為單一純量值(例如 😀 會變成 U+1F600 而非代理對)。
- 將序列複製到您的文件、錯誤回報或比對腳本中;若您手上已有標記並想驗證其所代表的內容,則切換到解碼模式。
至少四位數的格式是刻意設計的。大寫字母 A 會變成 U+0041 而非 U+41,這讓格式在 Unicode 標準下保持一致。100,000 個碼點的輸入上限能維持渲染與複製的流暢度,所以對非常大的資料量而言,腳本可能仍是合適的工具。對於一般的除錯片段和多數記錄檔行數,只要三次點擊——貼上、轉換、複製——就能搞定,完全不需要任何前置準備。
解碼模式:從 U+ 與 \u{} 標記重建文字
解碼模式是免費不需註冊查詢工具的另一半,當文件、記錄檔或原始碼已經提供純量標記時就會用到。可接受的格式包括前綴 U+ 後接大寫或小寫十六進位,以及 JavaScript 風格的反斜線 u 標記法(含用於補充值的大括號標記法),其定義與 String.fromCodePoint 完全相同。標記之間可用空格、逗號或換行分隔,工具只有在每個標記都通過純量值驗證後才會建構輸出字串。
有效的 Unicode 純量值範圍從 U+0000 到 U+10FFFF,但 U+D800 到 U+DDFFF 這段是保留給 UTF-16 代理碼位,永不對應獨立字元。工具會直接拒絕代理字元、越界數值、缺少前綴以及非十六進位的標記,而不是默默替換。這種嚴謹能保護您免於一整類錯誤——錯誤的慣例會與自己互相轉換,看似正確,直到遇到真正的消費者。當相鄰的值可能被誤認成同一個更長的十六進位數時,請保留前綴與標記邊界。
碼點、位元組與實體:選擇正確的表示法
Unicode 編碼 / 解碼工具精準地回答一個問題:一個字串包含哪些抽象字元。有幾個看起來很相似但需要不同工具的問題,而在格式之間複製貼上時選錯工具,是常見的混淆來源。
| 表示法 | 範例 | 本工具支援 | 適用於 |
|---|---|---|---|
| U+ 純量值 | U+00E9 | 是 | Unicode 編碼 / 解碼工具 |
| UTF-8 位元組 | C3 A9 | 否 | UTF-8 編碼 / 解碼工具 |
| HTML 數值實體 | é | 否 | HTML 實體編碼 / 解碼工具 |
| URL 百分比編碼 | %C3%A9 | 否 | URL 編碼 / 解碼工具 |
| UTF-8 的 Base64 | w6k= | 否 | Base64 編碼 / 解碼工具 |
U+00E9 對應到預先組成的字母 é。其 UTF-8 表示法是兩個位元組 C3 A9,而 HTML、URL 與 Base64 各自有不同跳脫規則的語法。當問題是字元識別時,請使用 Unicode 查詢工具;當通訊協定或檔案格式需要位元組層級或符記層級的編碼時,請切換到對應的工具。靜默混用表示法正是 bug 溜進正式記錄檔、比對腳本與檔名篩選器的方式——它們看起來都正確,直到遇到真實的輸入。
當一個可見符號變成多個碼點
碼點和使用者感知的字元並不相同,而這個差異在您貼上表情符號的當下就會顯現出來。可見符號 👩💻 是由三個純量值組成:U+1F469(女性)、U+200D(零寬連接字元)與 U+1F4BB(筆記型電腦)。國旗、家庭表情符號、帶組合記號的重音形式,以及許多書寫系統的字元,也都是序列而非單一值。查詢工具會揭露純量序列,並明確聲稱不會切分字素叢集。
正規化刻意不被執行。預先組成的 é 可能是 U+00E9,而一個看起來相同的分解形式可能是 U+0065 U+0301,兩者渲染結果一致,卻是不同的序列。這種精確性有助於診斷搜尋、識別碼、檔名與比對上的問題——兩個看似相同的字串卻拒絕匹配。控制字元與預設可忽略的碼點同樣會被納入:換行編碼為 U+000A,零寬連接字元則明確顯示為 U+200D。揭露這些數值能解釋意外的游標移動、無形的差異,或為何從其他來源貼上的文字無法通過精確比對——這正是免費不需註冊的查詢工具應該提供的答案,而且不應強迫您先通過註冊牆。