加载中...

| 类别 | 计算理论 |
| 领域 | 计算机科学 |
Unicode 是一项国际标准,旨在为世界上几乎所有书写系统中的每一个字符分配唯一的编号,称为码点。它的目标是用一套统一的字符集容纳中文、英文、阿拉伯文、表情符号等各种符号,从根本上消除多种区域编码并存所带来的冲突与乱码。
Unicode 的码点空间从零延伸到十万余,按语言和用途划分为若干平面。需要注意的是,Unicode 本身只规定字符与码点的对应关系,并不直接规定如何存储为字节;具体的字节表示由 UTF-8、UTF-16、UTF-32 等编码方式负责。每个码点通常以 U 加十六进制数的形式书写,例如汉字「中」的码点。
Unicode 已成为现代软件处理文本的基础,操作系统、编程语言、网页和数据库普遍采用它来表示字符。它使同一份文档可以自由混排多种语言而不冲突,也让表情符号得以跨平台统一显示。Unicode 联盟持续收录新字符并定期发布版本更新,不断扩展其覆盖范围,是全球信息交流的重要基石。

| 类别 | 计算理论 |
| 领域 | 计算机科学 |
登录 后参与讨论
暂无讨论,来发表第一条评论吧