自助法

✍ dations ◷ 2025-11-29 17:07:06 #自助法
在统计学中,自助法(Bootstrap Method,Bootstrapping,或自助抽样法)是一种从给定训练集中有放回的均匀抽样,也就是说,每当选中一个样本,它等可能地被再次选中并被再次添加到训练集中。自助法由Bradley Efron于1979年在《Annals of Statistics》上发表。当样本来自能以正态分布来描述的总体,其抽样分布(英语:Sampling Distribution)为正态分布;但当样本来自的总体无法以正态分布来描述,则以渐进分析法、自助法等来分析。采用随机可置换抽样(random sampling with replacement)。对于小数据集,自助法效果很好。最常用的一种是.632自助法,假设给定的数据集包含d个样本。该数据集有放回地抽样d次,产生d个样本的训练集。这样原数据样本中的某些样本很可能在该样本集中出现多次。没有进入该训练集的样本最终形成检验集(测试集)。 显然每个样本被选中的概率是1/d,因此未被选中的概率就是(1-1/d),这样一个样本在训练集中没出现的概率就是d次都未被选中的概率,即(1-1/d)d。当d趋于无穷大时,这一概率就将趋近于e-1=0.368,所以留在训练集中的样本大概就占原来数据集的63.2%。

相关

  • 牛瘟牛瘟病毒(德语:Rinderpest,英语:cattle plague或steppe murrain),是一种具感染性的牛只病毒,会引起牛瘟。这种病毒性疾病主要传染于水牛之间,但其他野生品种也有致病的记录。牛瘟与
  • 威尼斯共和国威尼斯共和国(威尼斯语:Serenìsima Repùblica Vèneta;意大利语:Serenissima Repubblica di Venezia)是意大利北部威尼斯人的城邦,以威尼斯为中心。它存在于8世纪至1797年。拉丁
  • 俗语俗语就是惯用语,指约定俗成,广泛流行于某时某地的口语。从广义来看,俗语包括谚语、歇后语(引注语)、常用的成语,但不包括并不通俗和古雅书面语中的成语,或名著中的名言警句;从狭义来
  • 元音词干元音词干(thematic vowel、theme vowel),在印欧语言学中,是结束于元音的名词或动词词干,这个元音出现于或在其他方面影响名词或动词的变形范例。这个元音和动词或名词都称为 th
  • 亨利亨利(Henry),符号表示为H,是电感的国际单位制导出单位。如果电路中电流每秒变化1安培,则会产生1伏特的感应电动势,此时电路的电感定义为1亨利。亨利在国际单位制中的量纲是V·A-1
  • 好利获得好利获得(意大利语:Olivetti S.p.A.),意大利资讯科技公司,成立于1908年,专门研发和出品商业器材和电脑系统。目前母公司为意大利电信。公司成立于1908年,以生产打字机起家。其后不
  • 贝凯希盖欧尔格·冯·贝凯希(Georg von Békésy,1899年6月3日-1972年6月13日),或贝凯希·哲尔吉(Békésy György),是一位出生在布达佩斯的匈牙利生物物理学家。1961年,他被授予了诺贝尔
  • 格物致知四配颜回 · 孟子 · 曾参 · 孔伋日本藤原惺窝 · 林罗山 · 室鸠巢新井白石 · 雨森芳洲朝鲜薛聪 · 权近 · 吉再 · 安珦 · 李穑李滉 · 王仁 · 李齐贤 
  • 射箭夏季奥林匹克运动会的射箭比赛首次出现在1900年夏季奥林匹克运动会,当时被列为表演项目,及后1904年夏季奥林匹克运动会同样被列为表演项目,1908年夏季奥林匹克运动会被列为奥运
  • 牛津大学萨默维尔学院牛津大学萨默维尔学院(Somerville College)是英国牛津大学的一个学院,成立于1879年,原称Somerville Hall,是牛津大学最早成立的女子学院之一。1994年才有第一个男性学员入学。 该