UTF-16 位元組轉換器能為您做什麼
使用本頁面檢查 UTF-16 小端與大端文字所使用的確切位元組,添加或省略位元組順序標記,或從十六進位位元組序列還原文字。工作區將來源、設定與結果整合在一起,讓您能理解哪些內容已變更,而非僅獲得一串無法解釋的剪貼簿值。建議先從一個已知的小範例開始,再處理不熟悉的資料。
字母 A 在 UTF-16 LE 中為 41 00,在 UTF-16 BE 中為 00 41。若加入 BOM,這些範例分別會以 FF FE 或 FE FF 開頭。可見的結果可隨時選取、複製與下載。系統不會自動複製或儲存任何內容,因此您可以停下來與來源進行比對,再決定下一步動作。
轉換的運作方式
每個 JavaScript UTF-16 程式碼單元會變成兩個位元組。小端序會先寫低位元組;大端序會先寫高位元組。BOM 在小端序為 FF FE,在大端序為 FE FF。解碼時會先檢查位元組數量、BOM、所選的位元組順序以及代理對是否有效,再顯示文字。
當輸入包含 BOM 時,自動模式最為安全。若沒有 BOM,則依據檔案或通訊協定所提供的資訊來選擇 LE 或 BE。在編碼時,自動模式會使用 LE,而 BOM 控制選項則另外決定是否要包含該標記。在一般使用情況下,輸入與輸出會保留在目前的瀏覽器分頁中。NexaCurrent 不會上傳工作區中的數值來執行此操作。重設會將已輸入的數值、設定、結果、訊息以及產生的下載檔案從工作區中清除。
如何使用 UTF-16 位元組轉換器
輸入或貼上能代表你任務的最小且完整的來源數值。選擇本頁面上顯示的來源格式、方向、位元組順序、輸出類型或範本類型。執行主要動作、閱讀摘要,並在使用複製或下載功能前檢視完整的可見結果。
將同時包含基本拉丁字母與表情符號的數值進行編碼,再使用相同的位元組順序解碼這些位元組,並確認能還原出完全相同的文字。若接收端應用程式有專屬的規格、範例或驗證工具,請將其作為第二重檢查。在本頁取得的成功結果僅能確認本頁所述的規則,無法保證其他系統也採用了相同的慣例。
錯誤、界線與復原
奇數的位元組數量、非十六進位字元、所選順序與 BOM 衝突、自動模式下缺少 BOM,以及孤立的代理單元會遭到拒絕,而不會進行猜測。錯誤訊息會清除先前的結果,以避免將過時的成功結果誤認為修正後的答案。請先修正第一則訊息,再重新執行操作。更改輸入或設定時,也會一併移除過時的複製回饋訊息。
文字輸入上限為 200,000 個字元,產生數量上限為 100 個項目,規則或綱要展開的上限為這些控制項旁所顯示的較小限制。這些限制是為了讓單一瀏覽器分頁保持流暢。針對大型檔案或批次作業,請使用串流的命令列工具,並保留一份原始副本。
限制與負責任的使用
無法從任意沒有標記的位元組中可靠地推斷出位元組順序。本頁僅處理 UTF-16 文字位元組,無法處理包含標頭、記錄配置或應用程式專屬中繼資料的完整檔案。
當可以使用無害的範本來證明相同行為時,請勿貼上真實的密碼、私密金鑰、存取權杖、個人資料或實際的客戶資料集。請將下載的輸出視為新檔案,保留來源資料直到目標系統接受為止,並在他需要重現結果時,記錄所選擇的格式。