ISO/IEC 8859

✍ dations ◷ 2025-08-18 05:14:03 #ISO/IEC 8859

ISO 8859,全称ISO 是国际标准化组织(ISO)及国际电工委员会(IEC)联合制定的一系列8位元字符集的标准,现时定义了15个字符集。

ASCII收录了空格及94个“可印刷字符”,足以给英语使用。但是,其他使用拉丁字母的语言(主要是欧洲国家的语言),都有一定数量的附加符号字母,故可以使用ASCII及控制字符以外的区域来储存及表示。

除了使用拉丁字母的语言外,使用西里尔字母的东欧语言、希腊语、泰语、现代阿拉伯语、希伯来语等,都可以使用这个形式来储存及表示。

1982年,ANSI与ECMA合作开启此项工作。1985年,公布了ECMA-94,即后来的ISO/IEC 8859 parts 1, 2, 3, 4。第5、6、7、8、9、10、11、12、13、14、15、16部分分别公布于1988年、1987年、1987年、1987年、1989年、1992年、2001年、1997年(正式宣布放弃研发)、1998年、1998年、1999年、2001年。

ISO 8859是基于ISO 2022标准的基础上,在ISO 2022规定的G0码位区域表示ISO 646的95个可打印字符;在C0与C1的控制字符码位区域,表示ISO 6429定义的控制字符;而在G1码位区域,则是由ISO 8859的16个部分各自定义扩展的可打印字符。因此,ISO 8859完全兼容7位的ASCII码。ISO 8859没有使用ISO 2022中的G2、G3区域,也不再使用ISO 2022定义的用来在不同的字符编码集或在同一个编码集的G0、G1、G2、G3区域间转换的“控制字符转义序列”。

ISO 8859统一了此前各国各语言的单独编码的混乱局面;废弃了ASCII/ISO 646使用的退格键开始的转义序列来表示变音字母的方法,而是在G1区域直接编码表示变音字母。

ISO 8859是在1980年代中期甚至1990年代才陆续公布的。因此,微软公司与IBM公司等此前已经在其产品,如MS-DOS, IBM PC上使用了各自定义的编码字符集(即“代码页”Codepage)。ISO 8859公布后,也出现了一些广泛使用的代码页兼容并扩充了ISO 8859。例如,Windows代码页1252作为英文及一些西欧语言版Windows操作系统的默认编码(locale),是 ISO 8859-1 的超集。主要扩充之处是把ISO 8859-1 的保留未用的C1区(即码位0x80-0x9F)用来编码一些可打印字符:€ ‚ ƒ „ … † ‡ ˆ ‰ Š ‹ Œ Ž ‘ ’ “ ” • – — ˜ ™ š › œ ž Ÿ 共计27个,其中各种引号就有8个。

由于英语没有任何重音字母(不计外来词),故可使用以上十五个字集中的任何一个来表示。

至于德语方面,因它除了 A-Z, a-z 外,只用 Ä, Ö, Ü, ä, ö, ß, ü 七个字母,而所有拉丁字集(1-4, 9-10, 13-16)均有此七个字母,故德语可使用以上十个字集中的任何一个来表示。

此系列中没有-12号的原因是,此计划原本要设计成一个包含塞尔特语族字符集的“Latin-7”,但后来塞尔特语族变成了ISO 8859-14 / Latin-8。亦有一说谓-12号本来是预留给印度天城体梵文的,但后来却搁置了。

每个字集定义最多96个字母或符号,在0xA0-0xFF根据不同字符集放入不同的字符。

在0xA0的位置是“不换行空格”。

在0xAD的位置,大部分都放入了“选择性连字号(英语:Soft hyphen)”(即只在一个文字在它的中间换行时才出现的连字号),若你使用的浏览器支援选择性连字号,上表将不会有任何显示。

黄色的是ISO/IEC 8859-7:2003版本及ISO/IEC 8859-8:1999版本新增的符号。LRM是“左至右符号”、RLM是“右至左符号”。

绿色的是该字集未有定义该位置。

0x00-0x1F、0x7F、0x80-0x9F在此字符集中未有定义。(控制字符是由ISO/IEC 6429定义)。

在ISO/IEC 8859-之中,国际标准化组织只替每个字符集定义了最多96个字符(0xA0-0xFF)。

ISO-8859-(在ISO与8859之间加上一连字号)则是由IANA根据ISO/IEC 8859-所定义的编码表。它除了ISO/IEC 8859-的字符外,还包括ASCII(0x20-0x7E)字符及65个控制字符(0x00-0x1F及0x7F-0x9F)。

这个号码本来是预留给印度天城体梵文的,但最终未有定义。印度有自己的编码-ISCII。

JIS X 0201是日语片假名的字符集标准,能与ISO 8859兼容。

VISCII是越南语在本土以外的侨民最常用的字符集标准。但因越南语有超过一百个重音字母,故不兼容ISO 8859。越南国家标准另有符合ISO8859标准的字符集,但字符需要组合,像泰文一样。

ISO 6438是非洲字母的字符集,但甚少被采纳。

ISO/IEC 8859 标准由 ISO/IEC 第一联合技术委员会第二分委员会第三工作组(ISO/IEC JTC 1/SC 2/WG 3)管理。2004 年 6 月,第三工作组解散,管理工作移交给第二分委员会。这份标准现在不再更新,因为这个分委员会唯一的工作组——第二工作组,正着力于ISO/IEC 10646的开发。

相关

  • 锁子甲锁子甲或称环锁铠、链甲(英语:Chainmail、Mail或Maille),是一种在铁器冷兵器时代出现的盔甲。汉唐环锁铠为制式铠甲的一种,宋代与北方游牧民族在远程武器弓弩和破甲箭簇都有一定
  • 平胸平胸,又称贫乳,是指女性乳房较小(罩杯尺寸在A或以下)的通称。平胸被部分人视为是女性身材不正常的表现,但随着ACG文化的兴起,平胸作为一种萌属性也开始受到一部分人的欢迎。成年女
  • 石冈水坝石冈坝是台湾经济部水利署中区水资源局所管理的拦河堰,于1977年完工营运,位在大甲溪下游,属于台中市境内,南岸属石冈区,北岸为东势区,流域面积1,061平方公里,约占大甲溪全流域面积
  • 京都国际漫画博物馆京都国际漫画博物馆(日语:京都国際マンガミュージアム/きょうとこくさいマンガミュージアム;英语:Kyoto International Manga Museum),位于日本京都府京都市中京区,是座以漫画为主题
  • 罗杰·泽拉兹尼罗杰·泽拉兹尼(Roger Zelazny,1937年5月13日-1995年7月14日),美国著名科幻与奇幻小说作家。罗杰·泽拉兹尼最出名的是编年史《安珀系列》(The Chronicles of Amber)。他赢得了三次
  • Refractor引擎Refractor引擎,是由瑞典斯德哥尔摩的Refraction Games所设计的游戏引擎,第一款使用该引擎的游戏是1999年11月发行的《猎鹰行动》。之后,Refraction Games被Digital Illusions C
  • 百万乱数表《百万乱数表》(英语:)或《一百万随机数与十万标准偏差》是一本由美国智库兰德公司编写,1955年出版的随机数表。创建随机数表的工作从1947年开始,随机数通过对电子轮盘生成结果的
  • 连姆·艾肯连姆·艾肯(Liam Aiken,1990年1月7日-)是一名曾在多部影片担任过主角的美国演员。其比较有名的作品有《外星神犬》,和《雷蒙·斯尼奇的不幸历险》。连姆·艾肯出生在纽约的曼哈顿
  • 程祖润程祖润(1805年-1860年),字鹿樵,一字雨琴,河南省祥符县人,祖籍丹徒,道光甲辰三甲第八十四名进士,丁未四川合州知州,先后任过广安、新繁、江津知县,后迁升成绵龙茂道,积劳成疾,卒于任所。咸
  • 柴立元柴立元(1966年9月29日-),江西万年人,中国冶金环境工程专家,中南大学冶金与环境学院教授、院长,中国工程院院士。1997年毕业于中南大学,获博士学位。