字节(Byte)是计算机信息技术用于计量存储容量的一种计量单位,通常情况下一字节等于八位。每个bit位是0/1两种状态,也就是说一个字节可以表示256个状态。
字符(Character)是指计算机中使用的字母、数字、字和符号,如’A’、‘B’、’$’、’&'等。
字节与字符:
ASCII 码中,一个英文字母为一个字节,一个中文汉字为两个字节。
UTF-8 编码中,一个英文字为一个字节,一个中文为三个字节。
Unicode 编码中,一个英文为一个字节,一个中文为两个字节。
UTF-16 编码中,一个英文字母字符或一个汉字字符存储都需要 2 个字节(Unicode 扩展区的一些汉字存储需要 4 个字节)。
UTF-32 编码中,世界上任何字符的存储都需要 4 个字节。