内存的单位、名称、全称及换算关系是什么?

相比之下,一个汉字因为编码比较复杂,通常占用两个字节的空间。这意味着在统计文本大小时,中文和英文所占用的字节数是不同的,这也是为什么同样字符数的中文文本往往比英文文本文件更大的原因。

评论 (3)

原来如此,以前写代码统计字符串长度时没太在意编码问题,今天终于搞清楚了。

这点确实是常识,不过对于写代码或者做数据处理的人来说,这点差异有时候还挺让人头大的,尤其是做跨语言开发的时候,字符集处理不好很容易出现乱码或者长度统计错误的问题。

原来如此,以前老觉得中文和英文长度一样占的内存应该差不多,搞半天是因为GBK或者UTF-8编码里汉字通常是2个甚至更多字节。难怪存个文档有时候差别挺大,涨知识了。