为什么 UTF-8 的中文在 GBK 环境里会变成「浣犲ソ」这类东西:
UTF-8 里「你」是 3 个字节
但如果乱码里出现
常见搭配:UTF-8 ↔ GBK(最常见)、UTF-8 ↔ Big5(繁体)、UTF-8 ↔ Shift_JIS(日文)、 UTF-8 ↔ Windows-1252(西欧)、GBK ↔ Big5(两岸三地互传)。
本页不做的事:不联网、不上传,所有转换与映射表构建都在你的浏览器里完成。
E4 BD A0;GBK 读的时候按 2 字节一组切,
就成了 E4BD 和 A0E4 两个汉字 —— 字节没丢,只是被重新解读了,
所以这种情况可以无损还原。但如果乱码里出现
? 或 �,说明字节已经被丢弃了,
那就是真丢了,任何工具都救不回来 —— 只能找原始文件。常见搭配:UTF-8 ↔ GBK(最常见)、UTF-8 ↔ Big5(繁体)、UTF-8 ↔ Shift_JIS(日文)、 UTF-8 ↔ Windows-1252(西欧)、GBK ↔ Big5(两岸三地互传)。
本页不做的事:不联网、不上传,所有转换与映射表构建都在你的浏览器里完成。