JavaScript進行UTF-8編碼與解碼

阿新 • • 發佈：2017-12-26

str 前端轉載 clas utf-8 處理序列一個 ket

JavaScript本身可通過charCodeAt方法得到一個字符的Unicode編碼，並通過fromCharCode方法將Unicode編碼轉換成對應字符。

但charCodeAt方法得到的應該是一個16位的整數，每個字符占用兩字節。在網絡上傳輸一般采用UTF-8編碼，JavaScript本身沒有提供此類方法。不過有一個簡便的辦法來實現UTF-8的編碼與解碼。

Web要求URL的查詢字符串采用UTF-8編碼，對於一些特殊字符或者中文等，會編碼成多個字節，變成%加相應16進制碼的形式。比如：漢字中將會被編碼為%E4%B8%AD。

為此JavaScript提供了encodeURIComponent與decodeURIComponent方法組合來對查詢字符串進行編碼與解碼。利用這一點，我們可以將encodeURIComponent方法編碼後的字符串進行處理，最終得到對應的字節數組。代碼如下：

function encodeUtf8(text) {
    const code = encodeURIComponent(text);
    const bytes = [];
    for (var i = 0; i < code.length; i++) {
        const c = code.charAt(i);
        if (c === ‘%‘) {
            const hex = code.charAt(i + 1) + code.charAt(i + 2);
            const hexVal = parseInt(hex, 
 16);
            bytes.push(hexVal);
            i += 2;
        } else bytes.push(c.charCodeAt(0));
    }
    return bytes;
}

這個方法的作用是得到某一個字符串對應UTF-8編碼的字節序列，可在服務端語言，如C#中通過 System.Text.Encoding.UTF8.GetString(bytes) 方法將字節序列解碼為相應的字符串。

而對應的，將以UTF-8編碼的字節序列解碼為String的JavaScript方法為：

function decodeUtf8(bytes) { 

    var encoded = "";
    for (var i = 0; i < bytes.length; i++) {
        encoded += ‘%‘ + bytes[i].toString(16);
    }
    return decodeURIComponent(encoded);
}

該方法將每一字節都轉換成%加16進制數字的表示形式，再通過decodeURIComponent方法解碼，即可得到相應的字符串。使用示例如下：

var array = encodeUtf8(‘ab熱cd!‘);
console.log(array);     // 打印 [97, 98, 231, 131, 173, 99, 100, 33] 
var content = decodeUtf8(array);
console.log(content);   // 打印 ab熱cd!

對應的C#使用示例如下：

var bytes = System.Text.Encoding.UTF8.GetBytes("ab熱cd!");
// 以下循環將打印 97 98 231 131 173 99 100 33
foreach (var b in bytes)
    Console.Write(b + " ");
Console.Write("\n");
var content = System.Text.Encoding.UTF8.GetString(bytes);
Console.WriteLine(content);  // 打印 ab熱cd!

通過以上方法組合，即可通過websocket在前端與後端之間以二進制的形式交換數據，方便協議的制定。

本文轉載於以下地址：JavaScript進行UTF-8編碼與解碼

JavaScript進行UTF-8編碼與解碼

str 前端轉載 clas utf-8 處理序列一個 ket JavaScript本身可通過charCodeAt方法得到一個字符的Unicode編碼，並通過fromCharCode方法將Unicode編碼轉換成對應字符。但charCodeAt方法得到的應該是一個16

JavaScript進行UTF-8編碼與解碼

JavaScript進行UTF-8編碼與解碼

刨根究底字符編碼之十一——UTF-8編碼方式與字節序標記

linux 下URL中 UTF-8編碼、GB2312編碼與漢字之間的轉換

Qt提示無法用“UTF-8”編碼解碼,無法編輯

GBK與UTF-8編碼區別

檢測當前的語言環境是否使用了 UTF-8 編碼（三篇文章：先用setlocale()設定編碼，再用nl_langinfo()進行檢測。locale物件可以使用langLocale.name() == "zh_CN"判斷）

如何選擇MySQL資料庫中GBK與UTF-8編碼

idna與utf-8編碼漏洞

php開啟mbstring擴展並設置支持utf-8編碼

在MyEclipse中設置jsp頁面為默認utf-8編碼

ASCII UTF-8 編碼

編碼與解碼

Python中的Unicode編碼和UTF-8編碼

從Python的角度來看編碼與解碼

解決excel打開utf-8編碼csv文件亂碼的bug

Java-IO流之轉換流的使用和編碼與解碼原理

html 編碼與解碼

Python3.X Socket 一個編碼與解碼的坑

08_Python編碼與解碼

C# MD5 32位加密 UTF-8編碼

JavaScript進行UTF-8編碼與解碼

相關推薦