javascript字符串默认utf-16编码,需用textencoder/textdecoder实现utf-8互转;btoa/atob仅支持ascii的base64编解码,unicode需textencoder预处理;十六进制与字符串互转需uint8array中转。

JavaScript 中字符串默认使用 UTF-16 编码,但实际开发中常需与 UTF-8、GBK、Base64 等编码格式互转(比如处理二进制数据、对接后端接口、解析文件内容等)。原生 JS 没有直接提供 encode/decode 任意编码的 API,但可通过组合标准 API 实现常见转换。
UTF-8 ↔ 字符串(最常用)
现代浏览器支持 TextEncoder 和 TextDecoder,专用于 UTF-8 与字节数组的双向转换:
- 字符串 → UTF-8 字节数组:
new TextEncoder().encode(str)返回Uint8Array - UTF-8 字节数组 → 字符串:
new TextDecoder('utf-8').decode(uint8Array)
注意:不传参数时 TextDecoder 默认就是 'utf-8',但显式写出更清晰;这两个 API 在 Node.js(v11+)和主流浏览器中均已稳定支持。
Base64 ↔ 字符串(兼容性好)
利用浏览器内置的 btoa() / atob() 可快速实现 Base64 编解码,但仅支持 ASCII 字符(即不能直接处理中文等 Unicode 字符):
- ASCII 字符串 → Base64:
btoa('hello')→'aGVsbG8=' - Base64 → ASCII 字符串:
atob('aGVsbG8=')→'hello'
要支持中文等 Unicode 字符,需先用 encodeURIComponent + unescape(或 TextEncoder)预处理。推荐写法:
// 字符串 → Base64(支持 Unicode)
function strToBase64(str) {
const encoder = new TextEncoder();
const bytes = encoder.encode(str);
const bin = Array.from(bytes, b => String.fromCharCode(b)).join('');
return btoa(bin);
}
// Base64 → 字符串(支持 Unicode)
function base64ToStr(base64) {
const bin = atob(base64);
const bytes = new Uint8Array(bin.length);
for (let i = 0; i
<h3>GBK / GB2312 等中文编码(需第三方库)</h3>
<p>JS 原生不支持 GBK 解码,遇到旧系统返回的 GBK 编码数据(如某些 CSV 或表单提交),需借助库如 <code>iconv-lite</code>(Node.js)或 <code>encoding-japanese</code>(浏览器端):</p>
- Node.js 中:
iconv-lite.decode(buffer, 'gbk')直接得到字符串 - 浏览器中可引入
encoding-japanese,用Encoding.convert()处理 ArrayBuffer
这类场景较少见,但一旦遇到无法绕过,不建议手动查表实现——易出错且维护成本高。
十六进制 / 二进制字符串 ↔ 字符串
常用于加解密、协议解析等场景,可用 Uint8Array 搭配 toString(16) 或 parseInt() 转换:
- 字符串 → 十六进制字符串:
Array.from(new TextEncoder().encode(str), b => b.toString(16).padStart(2,'0')).join('') - 十六进制字符串 → 字符串:
new TextDecoder().decode(new Uint8Array(hexStr.match(/.{2}/g).map(h => parseInt(h, 16))))
注意:十六进制字符串必须为偶数长度,且只含 0–9、a–f(大小写均可)。
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南











