跳至主要內容
Lizely

文字轉二進位轉換器

將文字編碼為可見的 8 位元 UTF-8 二進位位元組,或解碼嚴格格式化的二進位位元組回傳為有效的 Unicode 文字。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.選擇「文字轉 UTF-8 二進位」或「UTF-8 二進位轉文字」。
  2. 2.輸入文字或精確的 8 位元位元組組,並以一個空格分隔。
  3. 3.選擇「轉換」並確認位元組數量或解碼後的文字,再複製至其他位置。

關於文字轉二進位轉換器

文字轉二進位轉換器讓位元組的表示方式變得明確。在「文字轉 UTF-8 二進位」模式下,會使用瀏覽器標準的 TextEncoder 將輸入的 Unicode 字串編碼,並以每一個位元組為八個零填充的二進位位元,以一個空格分隔。在「UTF-8 二進位轉文字」模式下,會接受相同嚴格格式的輸入,並使用致命的 UTF-8 解碼器進行解碼。輸入與輸出皆保留在當前標籤中,不會傳送至 Lizely。

若未說明字元編碼與分組規則,二進位文字往往含義不明。此工具不會把 Unicode 碼點說成永遠只占一個位元組。ASCII A 占一個位元組,é 使用兩個 UTF-8 位元組,歐元符號使用三個,而像 😀 這樣的增補平面表情符號則使用四個。因此輸出代表的是已編碼位元組,不是 JavaScript UTF-16 碼元、字形像素、未分組的抽象位元,也不是把每個 Unicode 純量值轉成以 2 為基底的表示法。

編碼支援最多 20,000 UTF-16 字元單位。解碼支援最多 180,000 個輸入字元,並要求每組必須為八個二進位位元,且僅以一個普通空格分隔。它拒絕字首如 0b、逗號、製表符、多個空格、七位元組、九位元組、前後空白字元,以及任何非 0 或 1 的字元。值絕不會補零、修剪、猜測或靜默丟棄。

解碼器使用致命的 UTF-8 驗證。即使位元組結構完整,仍可能為無效文字——例如,僅有前導位元組而無其續位元組。無效、過長、補位、超出範圍的序列會以明確錯誤終止,而非被替換為 Unicode 替換字元。這讓反向操作在檢查精確的 UTF-8 位元組串時非常有用,同時避免了錯誤的迴圈轉換。

八個獨立的標準案例涵蓋 ASCII、一個詞、雙位元組拉丁文字、三字元組貨幣符號、四字元組表情符號、CJK 文字、換行控制位元組,以及混合寬度的字串。預期的位元組值與實作無關。測試也涵蓋最大輸入預算、錯誤分組、重複空格、不完整的 UTF-8,以及位元組計數。

這是一個編碼工具,而非加密工具。二進位輸出包含與原始文字相同的資訊,並無保密性、認證、完整性、壓縮或密碼保護功能。任何人都可以解碼它。此工具也不解析數值二進位、機器指令、檔案、圖片、Base64、十六進位、摩斯密碼,或自訂的舊式字元集。若需這些功能,請使用鄰近的工具。

僅在能正確保留普通空格與行內容的系統中複製或儲存結果。聊天客戶端與富文字編輯器可能會合併空格或插入換行,導致嚴格解碼失敗。在協議、原始碼或法證工作中,應以規格與目標系統實際的位元組序列為準,而非依賴字型如何顯示輸出。

方法與來源

限制文字為最多 20,000 UTF-16 字元單位,使用 WHATWG UTF-8 TextEncoder 進行編碼,將每個位元組序列化為八個基數 2 位元,並以一個 ASCII 空格分隔。解碼時,要求符合精確正規語言 [01]{8}( [01]{8})*,限制輸入為最多 180,000 字元單位,將每組解析為一個位元組,並使用致命的 UTF-8 TextDecoder 以確保錯誤序列不會被替換而直接失敗。八個獨立的 Unicode 標準案例涵蓋從一個到四個位元組的編碼以及混合輸入。

常見問題

一個字元一定會變成八個位元嗎?
沒有。輸出顯示 UTF-8 位元組。ASCII 使用一個位元組,而許多帶重音、CJK、符號和表情符號字元則使用兩到四個位元組。
為何二進位組必須恰好為八個位元?
解碼器以位元組為單位運作。精確的分組可避免模糊的補零、修剪或猜測。
無效的 UTF-8 位元組會如何處理?
解碼失敗。此工具使用致命驗證,不會將錯誤的位元組用替換字元取代。
二進位文字是加密的嗎?
不是。這是一種可逆的表示方式,僅提供相同資訊,並無保密性或安全性。

編碼與加密 使用指南

查看全部