无需登录 数据私有 本地保存

Unicode字符表 - 在线浏览与复制符号

603
0
0
0
「Unicode」:国际通用的字符编码标准,为世界上几乎所有书写系统的每个字符分配唯一的数字标识。目前Unicode已收录超过十四万个字符,涵盖全球一百多种语言文字以及大量符号和图形。 「码点」(Code Point):Unicode为每个字符分配的唯一数字编号。码点用十六进制数表示,前缀为「U+」。例如大写字母A的码点为「U+0041」,汉字「中」的码点为「U+4E2D」。码点范围从U+0000到U+10FFFF。 「区块」(Block):Unicode标准中将功能相近或来源相同的字符划分成的逻辑分组。每个区块有明确的名称和码点范围。例如「基本拉丁文」(Basic Latin)区块包含U+0000到U+007F的字符。 「BMP」(Basic Multilingual Plane,基本多语言平面):Unicode码点空间中的第一个平面,范围为U+0000到U+FFFF,包含最常用的六万五千多个字符,包括绝大多数现代语言的文字和常用符号。 「补充平面」(Supplementary Plane):BMP之外的Unicode平面,编号从第1平面到第16平面。补充平面包含较少使用的字符、历史文字、表情符号等,码点范围从U+10000开始。补充平面的字符需要使用代理对(Surrogate Pair)表示。 「代理对」(Surrogate Pair):用于在UTF-16编码中表示BMP之外的Unicode字符的一对码元。一个补充平面字符由两个16位码元组成,称为「高位代理」和「低位代理」。 「UTF-8」:一种可变长度的Unicode编码方式,使用1到4个字节编码一个字符。ASCII字符只需1个字节,中文字符通常需要3个字节。UTF-8是互联网上使用最广泛的编码方式。 「UTF-16」:使用16位码元的Unicode编码方式。BMP内的字符用一个码元表示,补充平面字符用代理对(两个码元)表示。 「UTF-32」:使用固定32位(4个字节)编码每个Unicode字符的方式。优点是处理简单,缺点是空间效率较低。 「字符名称」(Character Name):Unicode标准为每个字符定义的官方英文名称,是字符的唯一标识之一。例如「U+0041」的名称为「LATIN CAPITAL LETTER A」。字符名称可用于搜索和识别字符。 「制表符」(Box Drawing Characters):Unicode中用于绘制文本界面边框和表格线的特殊字符,包括水平线「─」、垂直线「│」、各种拐角「┌┐└┘」和交叉「┼」等。在终端应用和文本艺术中广泛使用。 「变体选择符」(Variation Selector):用于指定前一个字符的显示样式的特殊字符。例如emoji变体选择符可以决定一个字符是显示为文本样式还是emoji样式。 「组合字符」(Combining Character):附加在前一个字符上修改其显示效果的字符,如重音符号、声调标记等。例如「é」可以由基本字母「e」和组合重音符「́」组合而成。 「等宽字体」(Monospaced Font):每个字符占据相同宽度的字体。在显示Unicode字符时,等宽字体能确保表格和对齐效果正常,是查看和编辑Unicode文本的理想选择。