自助法

✍ dations ◷ 2025-06-28 05:24:57 #自助法
在统计学中,自助法(Bootstrap Method,Bootstrapping,或自助抽样法)是一种从给定训练集中有放回的均匀抽样,也就是说,每当选中一个样本,它等可能地被再次选中并被再次添加到训练集中。自助法由Bradley Efron于1979年在《Annals of Statistics》上发表。当样本来自能以正态分布来描述的总体,其抽样分布(英语:Sampling Distribution)为正态分布;但当样本来自的总体无法以正态分布来描述,则以渐进分析法、自助法等来分析。采用随机可置换抽样(random sampling with replacement)。对于小数据集,自助法效果很好。最常用的一种是.632自助法,假设给定的数据集包含d个样本。该数据集有放回地抽样d次,产生d个样本的训练集。这样原数据样本中的某些样本很可能在该样本集中出现多次。没有进入该训练集的样本最终形成检验集(测试集)。 显然每个样本被选中的概率是1/d,因此未被选中的概率就是(1-1/d),这样一个样本在训练集中没出现的概率就是d次都未被选中的概率,即(1-1/d)d。当d趋于无穷大时,这一概率就将趋近于e-1=0.368,所以留在训练集中的样本大概就占原来数据集的63.2%。

相关

  • 尼克尔·奥里斯姆尼克尔·奥里斯姆(Nicole Oresme,又称Nicolas Oresme、Nicholas Oresme或Nicolas d'Oresme ?-1382年7月11日)是中古晚期最知名、最具影响力哲学家之一。本身是经济学家、数学家
  • 存水弯存水弯,是U型、S型、或J形的管件装置,让废水及污水流进地下室筏基,并且阻止臭气及其他气体逆流或倒灌进室内, Alexander Cummings(英语:Alexander Cummings)在1775年发明S型弯的,但
  • 固体化学固体化学是研究固体结构、性质、合成、表征等的一门化学分支,它综合了固体物理学、矿物学、晶体学、冶金学、材料科学等多个学科的知识。固体无机化学与商业产品联系紧密。工
  • 黄藻黄藻(Xanthophyceae)是一类属于不等鞭毛类的藻类生物。体类型为单细胞、群体、多核管状或丝状体。细胞壁含多量果胶质。运动的个体和动孢子具有2条不等长鞭毛,极少数具有1条鞭
  • 马克西姆·孔采维奇马克西姆·孔采维奇(法语:Maxim Lvovich Kontsevich,俄语:Максим Львович Концевич,1964年8月25日-),法国俄裔数学物理学家。他的工作领域是扭结理论,量子化和
  • 单磷酸鸟苷鸟苷酸(Guanosine monophosphate,或译鸟苷单磷酸、一磷酸鸟苷、鸟苷一磷酸或单磷酸鸟苷,缩写GMP)是一种核苷酸,常见于食品添加剂中作为鲜味剂,其结构由磷酸基团、五碳糖,以及鸟嘌呤
  • 马头墙马头墙,又称马头山墙,是中国传统建筑中封火墙的一种造型,为徽派建筑重要标志之一。因其墙顶部分形似马头而得名。依据马头墙顶的马头形状可分为鹊尾式、印斗式、坐吻式、金印式
  • 荷兰体育荷兰1,700万人口中,有约450万人加入了体育团体。三分之二以上的荷兰人每个礼拜参加至少一次体育活动。荷兰国内参加人数最多的体育运动是足球。荷兰国家足球队是世界强队,曾经
  • 法国航空447号班机空难法国航空447号班机原定由巴西里约热内卢加利昂国际机场飞往法国巴黎戴高乐机场。2009年6月1日,该航班一架空中客车A330-203客机(注册编号:F-GZCP),载有216名乘客以及12名机组人员
  • 赛洛西宾赛洛西宾(Psilocybin (/ˌsɪləˈsaɪbɪn/ SIL-ə-SY-bin)是由超过两百种蘑菇(合称迷幻蘑菇,其中主要是是Psilocybe属的成员,如P. azurescens , P. semilanceata和P. cyanescens