ISO/IEC 8859

✍ dations ◷ 2025-09-12 21:44:32 #ISO/IEC 8859

ISO 8859,全称ISO 是国际标准化组织(ISO)及国际电工委员会(IEC)联合制定的一系列8位元字符集的标准,现时定义了15个字符集。

ASCII收录了空格及94个“可印刷字符”,足以给英语使用。但是,其他使用拉丁字母的语言(主要是欧洲国家的语言),都有一定数量的附加符号字母,故可以使用ASCII及控制字符以外的区域来储存及表示。

除了使用拉丁字母的语言外,使用西里尔字母的东欧语言、希腊语、泰语、现代阿拉伯语、希伯来语等,都可以使用这个形式来储存及表示。

1982年,ANSI与ECMA合作开启此项工作。1985年,公布了ECMA-94,即后来的ISO/IEC 8859 parts 1, 2, 3, 4。第5、6、7、8、9、10、11、12、13、14、15、16部分分别公布于1988年、1987年、1987年、1987年、1989年、1992年、2001年、1997年(正式宣布放弃研发)、1998年、1998年、1999年、2001年。

ISO 8859是基于ISO 2022标准的基础上,在ISO 2022规定的G0码位区域表示ISO 646的95个可打印字符;在C0与C1的控制字符码位区域,表示ISO 6429定义的控制字符;而在G1码位区域,则是由ISO 8859的16个部分各自定义扩展的可打印字符。因此,ISO 8859完全兼容7位的ASCII码。ISO 8859没有使用ISO 2022中的G2、G3区域,也不再使用ISO 2022定义的用来在不同的字符编码集或在同一个编码集的G0、G1、G2、G3区域间转换的“控制字符转义序列”。

ISO 8859统一了此前各国各语言的单独编码的混乱局面;废弃了ASCII/ISO 646使用的退格键开始的转义序列来表示变音字母的方法,而是在G1区域直接编码表示变音字母。

ISO 8859是在1980年代中期甚至1990年代才陆续公布的。因此,微软公司与IBM公司等此前已经在其产品,如MS-DOS, IBM PC上使用了各自定义的编码字符集(即“代码页”Codepage)。ISO 8859公布后,也出现了一些广泛使用的代码页兼容并扩充了ISO 8859。例如,Windows代码页1252作为英文及一些西欧语言版Windows操作系统的默认编码(locale),是 ISO 8859-1 的超集。主要扩充之处是把ISO 8859-1 的保留未用的C1区(即码位0x80-0x9F)用来编码一些可打印字符:€ ‚ ƒ „ … † ‡ ˆ ‰ Š ‹ Œ Ž ‘ ’ “ ” • – — ˜ ™ š › œ ž Ÿ 共计27个,其中各种引号就有8个。

由于英语没有任何重音字母(不计外来词),故可使用以上十五个字集中的任何一个来表示。

至于德语方面,因它除了 A-Z, a-z 外,只用 Ä, Ö, Ü, ä, ö, ß, ü 七个字母,而所有拉丁字集(1-4, 9-10, 13-16)均有此七个字母,故德语可使用以上十个字集中的任何一个来表示。

此系列中没有-12号的原因是,此计划原本要设计成一个包含塞尔特语族字符集的“Latin-7”,但后来塞尔特语族变成了ISO 8859-14 / Latin-8。亦有一说谓-12号本来是预留给印度天城体梵文的,但后来却搁置了。

每个字集定义最多96个字母或符号,在0xA0-0xFF根据不同字符集放入不同的字符。

在0xA0的位置是“不换行空格”。

在0xAD的位置,大部分都放入了“选择性连字号(英语:Soft hyphen)”(即只在一个文字在它的中间换行时才出现的连字号),若你使用的浏览器支援选择性连字号,上表将不会有任何显示。

黄色的是ISO/IEC 8859-7:2003版本及ISO/IEC 8859-8:1999版本新增的符号。LRM是“左至右符号”、RLM是“右至左符号”。

绿色的是该字集未有定义该位置。

0x00-0x1F、0x7F、0x80-0x9F在此字符集中未有定义。(控制字符是由ISO/IEC 6429定义)。

在ISO/IEC 8859-之中,国际标准化组织只替每个字符集定义了最多96个字符(0xA0-0xFF)。

ISO-8859-(在ISO与8859之间加上一连字号)则是由IANA根据ISO/IEC 8859-所定义的编码表。它除了ISO/IEC 8859-的字符外,还包括ASCII(0x20-0x7E)字符及65个控制字符(0x00-0x1F及0x7F-0x9F)。

这个号码本来是预留给印度天城体梵文的,但最终未有定义。印度有自己的编码-ISCII。

JIS X 0201是日语片假名的字符集标准,能与ISO 8859兼容。

VISCII是越南语在本土以外的侨民最常用的字符集标准。但因越南语有超过一百个重音字母,故不兼容ISO 8859。越南国家标准另有符合ISO8859标准的字符集,但字符需要组合,像泰文一样。

ISO 6438是非洲字母的字符集,但甚少被采纳。

ISO/IEC 8859 标准由 ISO/IEC 第一联合技术委员会第二分委员会第三工作组(ISO/IEC JTC 1/SC 2/WG 3)管理。2004 年 6 月,第三工作组解散,管理工作移交给第二分委员会。这份标准现在不再更新,因为这个分委员会唯一的工作组——第二工作组,正着力于ISO/IEC 10646的开发。

相关

  • mol摩尔、莫耳、莫尔是一个音译的词,它可能是翻译自Mole,More或Moore。有时会被翻译成“摩尔”或“穆尔”。有时会被翻译成“莫尔”。
  • 4f13 6s22, 8, 18, 31, 8, 2蒸气压第一:596.7 kJ·mol−1 第二:1160 kJ·mol−1 第三:2285 kJ·mol主条目:铥的同位素铥是一种化学元素,符号Tm,原子序数69,是一种金属。铥是第二稀
  • font color=#ffffff河南/font河南省高等学校列表,是中国大陆高等学校列表的河南省部分。截至2017年5月31日,河南共有38所公立本科高校、17所民办本科高校、59所公立专科高校、20所民办专科高校、11所成人
  • 单向蚓目蚯蚓是对环节动物门环带纲寡毛类动物的通称。在科学分类中,它们属于单向蚓目。身体细长,两侧对称,由很多环节组成,每节外形都很相似;没有骨骼,在体表覆盖一层具有色素的薄角质层。
  • 濑越宪作濑越宪作(1889年5月22日-1972年7月27日),出生于日本广岛,日本职业围棋棋手。2009年,入选围棋殿堂。他的棋是由祖父启蒙,然后全凭自修,达到日本围棋顶尖水平。濑越第一个内弟子是松泽
  • 新明斯克协议《新明斯克协议》(英语:Minsk II;或称明斯克协议II)是2015年德国、法国、乌克兰和俄罗斯四国领导人在白俄罗斯首都明斯克签订的一系列落实2014年《明斯克协议》的措施。2015年2
  • 天主教罗克福德教区天主教罗克福德教区(拉丁语:Dioecesis Peoriensis、英语:Roman Catholic Diocese of Rockford)是美国一个罗马天主教教区,属芝加哥总教区。成立于1908年9月23日。范围包括伊利诺
  • 老挝国旗现行老挝国旗于1975年共产主义者上台后启用,由红色、蓝色和白色组成,蓝色代表老挝富饶美丽的国土,以及老挝人民热爱和平安宁的生活。红色象征革命,表明老挝人民不惜以鲜血为代价
  • 约翰·博纳姆约翰·亨利·博纳姆(英语:John Henry Bonham,1948年5月31日-1980年9月25日),英国鼓手、作曲家,因作为齐柏林飞船乐队的鼓手而知名。他被认为是摇滚历史上最伟大的鼓手之一。在乐队
  • 等待,只为与你相遇《等待,只为与你相遇》是日本作家市川拓司的一部爱情小说,其后改编成电影,于2007年6月2日上映。幼时发誓要当水草店老板的远山智史,一天遇到了在超级模特儿的森川铃音在门口等待