自助法

✍ dations ◷ 2025-11-24 14:14:20 #自助法
在统计学中,自助法(Bootstrap Method,Bootstrapping,或自助抽样法)是一种从给定训练集中有放回的均匀抽样,也就是说,每当选中一个样本,它等可能地被再次选中并被再次添加到训练集中。自助法由Bradley Efron于1979年在《Annals of Statistics》上发表。当样本来自能以正态分布来描述的总体,其抽样分布(英语:Sampling Distribution)为正态分布;但当样本来自的总体无法以正态分布来描述,则以渐进分析法、自助法等来分析。采用随机可置换抽样(random sampling with replacement)。对于小数据集,自助法效果很好。最常用的一种是.632自助法,假设给定的数据集包含d个样本。该数据集有放回地抽样d次,产生d个样本的训练集。这样原数据样本中的某些样本很可能在该样本集中出现多次。没有进入该训练集的样本最终形成检验集(测试集)。 显然每个样本被选中的概率是1/d,因此未被选中的概率就是(1-1/d),这样一个样本在训练集中没出现的概率就是d次都未被选中的概率,即(1-1/d)d。当d趋于无穷大时,这一概率就将趋近于e-1=0.368,所以留在训练集中的样本大概就占原来数据集的63.2%。

相关

  • 螨传播螨(英语:mite, 音mán)是一种八足生物,是蜘蛛的近亲。螨的体形极小,必须借助显微镜观察。螨又可分为尘螨(dust mite)与农业螨,其中农业螨又有叶螨(spider mite)、拟叶螨(false spider mi
  • 环孢素环孢素(英语:Cyclosporine、Cyclosporine A、Ciclosporin)也称为“环孢菌素”或“环孢霉素”,是一种被广泛用于预防器官移植排斥的免疫抑制剂。它借由抑制T细胞的活性跟生长而达
  • 行动理论行动理论是一哲学课题,讨论人类作出意识行为的过程。这方面的讨论可追溯至亚里士多德的尼各马科伦理学。其后行动理论被纳入社会科学的讨论范围。随着心理学和神经科学的发展
  • 物理教育物理教育是全世界的中学和大学教育的一个重要组成部分。许多综合大学都拥有物理专业。由于物理学是自然科学和工程技术的基础学科,因此物理也是取得科学和工程学位的必修课程
  • 最小平方法最小二乘法(英语:least squares method),又称最小平方法,是一种数学优化方法。它通过最小化误差的平方和寻找数据的最佳函数匹配。利用最小二乘法可以简便的求得未知的数据,并使得
  • 最大行政区一级行政区是指直接受国家直辖、或独立政权管辖的行政区划,属于相对概念。在汉语环境中,直属中央政府管辖之行政区称为“省级行政区”(或“国家一级行政区”)。而由多个国家合并
  • 海冰海冰是所有出现在海上的冰的统称。除由海水直接冻结而成的冰外,海冰还包括来源于陆地的河冰、湖冰和冰川冰等。浮冰是指任何漂浮在海上,能够随风和流漂流的冰;固定冰则是沿着海
  • 350110 数学 120 信息科学与系统科学 130 力学 140 物理学 150 化学 160 天文学 170 地球科学 180 生物学210 农学 220 林学 230 畜牧、兽医科学 240 水产学310 
  • 噻嗪类利尿剂噻嗪类利尿剂(英语:Thiazides),是利尿剂的一类。此类药物可抑制氯化钠在远端曲小管(英语:Distal convoluted tubule)的再吸收(英语:reabsorption)。这些药会作用在远端曲小管的细胞管
  • 新墨西哥州立大学新墨西哥州立大学(New Mexico State University, NMSU),简称为新墨州大,是一所创建于公元1888年,男女合校的知名美国公立大学。位于美国新墨西哥州南部的第二大城拉斯库塞斯(La