加载中...
| 类别 | 计算理论 |
| 领域 | 计算机科学 |
字符编码是把人类使用的文字符号映射为计算机能够存储和处理的数字(最终是字节序列)的规则。由于计算机只能处理二进制数,每个字符必须先被赋予一个编号,再按某种方案转换为字节,才能被保存、传输和显示。
字符编码涉及两个层面:字符集规定哪些字符以及它们对应的编号,编码方式规定如何把编号转为字节。早期的 ASCII 用一个字节表示英文字符;为容纳更多文字,出现了 GB2312、Big5 等区域性多字节编码。这些编码彼此不兼容,同一字节序列在不同编码下显示为不同文字,造成所谓的乱码问题。
字符编码贯穿于文本文件、网页、数据库和网络通信的方方面面。为解决编码混乱,Unicode 统一了全球字符的编号,UTF-8 等编码方案随之成为互联网的事实标准。开发者在读写文件、处理网络数据时必须明确指定编码,否则极易出现乱码。正确理解和声明字符编码,是处理多语言文本的基本前提。
| 类别 | 计算理论 |
| 领域 | 计算机科学 |
登录 后参与讨论
暂无讨论,来发表第一条评论吧