大数定律

✍ dations ◷ 2025-11-23 14:39:14 #大数定律
在数学与统计学中,大数定律又称大数法则、大数律,是描述相当多次数重复实验的结果的定律。根据这个定律知道,样本数量越多,则其算术平均值就有越高的概率接近期望值。大数定律很重要,因为它“说明”了一些随机事件的均值的长期稳定性。人们发现,在重复试验中,随着试验次数的增加,事件发生的频率趋于一个稳定值;人们同时也发现,在对物理量的测量实践中,测定值的算术平均也具有稳定性。比如,我们向上抛一枚硬币,硬币落下后哪一面朝上是偶然的,但当我们上抛硬币的次数足够多后,达到上万次甚至几十万几百万次以后,我们就会发现,硬币每一面向上的次数约占总次数的二分之一,亦即偶然之中包含着必然。切比雪夫不等式的一个特殊情况、辛钦定理和伯努利大数定律都概括了这一现象,都称为大数定律。例如,抛掷一颗均匀的6面的骰子,1,2,3,4,5,6应等概率出现,所以每次扔出骰子后,出现点数的期望值是1 + 2 + 3 + 4 + 5 + 6 6 = 3.5 {displaystyle {frac {1+2+3+4+5+6}{6}}=3.5}根据大数定理,如果多次抛掷骰子,随着抛掷次数的增加,平均值(样本平均值)应该接近3.5,根据大数定理,在多次伯努利实验中,实验概率最后收敛于理论推断的概率值,对于伯努利随机变量,理论推断的成功概率就是期望值,而若对n个相互独立的随机变量的平均值,频率越多则相对越精准。例如硬币投掷即伯努利实验,当投掷一枚均匀的硬币,理论上得出的正面向上的概率应是1/2。因此,根据大数定理,正面朝上的比例在相对“大”的数字下,“理应”接近为1/2,尤其是正面朝上的概率在n次实验(n接近无限大时)后应几近收敛到1/2。即使正面朝上(或背面朝上)的比例接近1/2,几乎很自然的正面与负面朝上的绝对差值(absolute difference差值范围)应该相应随着抛掷次数的增加而增加。换句话说,绝对差值的概率应该是会随着抛掷次数而接近于0。直观的来看,绝对差值的期望会增加,只是慢于抛掷次数增加的速度。大数定律主要有两种表现形式:弱大数定律和强大数定律。定律的两种形式都肯定无疑地表明,样本均值收敛于真值其中 X 1 {displaystyle X_{1}} , X 2 {displaystyle X_{2}} , ... 是独立同分布、期望值 E ⁡ ( X 1 ) = E ⁡ ( X 2 ) = ⋯ = μ {displaystyle operatorname {E} (X_{1})=operatorname {E} (X_{2})=,cdots ,=mu } 且皆勒贝格可积的随机变量构成的无穷序列。 X j {displaystyle X_{j}} 的勒贝格可积性意味着期望值 E ⁡ ( X j ) {displaystyle operatorname {E} (X_{j})} 存在且有限。方差 Var ⁡ ( X 1 ) = Var ⁡ ( X 2 ) = ⋯ = σ 2 < ∞ {displaystyle operatorname {Var} (X_{1})=operatorname {Var} (X_{2})=,cdots ,=sigma ^{2}<infty } 有限的假设是非必要的。很大或者无穷大的方差会使其收敛得缓慢一些,但大数定律仍然成立。通常采用这个假设来使证明更加简洁。强和弱之间的差别在所断言的收敛的方式。对于这些方式的解释,参见随机变量的收敛。弱大数定律也称为辛钦定理,陈述为:样本均值依概率收敛于期望值。也就是说对于任意正数 ε,强大数定律指出,样本均值以概率1收敛于期望值。即设 a 1 ,   a 2 ,   …   ,   a n ,   … {displaystyle a_{1}, a_{2}, dots , a_{n}, dots } 为相互独立的随机变量,其数学期望为: E ⁡ ( a i ) = μ ( i = 1 ,   2 ,   … ) {displaystyle operatorname {E} (a_{i})=mu quad (i=1, 2, dots )} ,方差为: Var ⁡ ( a i ) = σ 2 ( i = 1 ,   2 ,   … ) {displaystyle operatorname {Var} (a_{i})=sigma ^{2}quad (i=1, 2, dots )}则序列 a ¯ = 1 n ∑ i = 1 n a i {displaystyle {overline {a}}={frac {1}{n}}sum _{i=1}^{n}a_{i}} 依概率收敛于 μ {displaystyle mu } (即收敛于此数列的数学期望 E ( a i ) {displaystyle E(a_{i})} )。换言之,在定理条件下,当 n {displaystyle n} 无限变大时, n {displaystyle n} 个随机变量的算术平均将变成一个常数。设在 n {displaystyle n} 次独立重复伯努利试验中, 事件 X {displaystyle X} 发生的次数为 n x {displaystyle n_{x}} 。 事件 X {displaystyle X} 在每次试验中发生的总体概率为 p {displaystyle p} 。 n x n {displaystyle {frac {n_{x}}{n}}} 代表样本发生事件 X {displaystyle X} 的频率。大数定律可用概率极限值定义: 则对任意正数 ε > 0 {displaystyle varepsilon >0} ,下式成立:定理表明事件发生的频率依概率收敛于事件的总体概率。 定理以严格的数学形式表达了频率的稳定性。 就是说当 n {displaystyle n} 很大时,事件发生的频率于总体概率有较大偏差的可能性很小。

相关

  • 爱德华氏症候群参数所指定的目标页面不存在,建议更正成存在页面或直接建立下列一个页面(建立前请先搜寻是否有合适的存在页面可以取代):]]爱德华氏综合征(亦称18-三体综合征)是一种遗传疾病,是(所
  • 太空旅游太空游客指非以执行任务(例如进行实验或工作)为目的,而搭乘航天器参与太空飞行的人。在苏联解体后,由于航天器的操作成本极大,同时要付给哈萨克拜科努尔航天中心地租与使用场地费
  • 尤利乌斯·凯撒盖乌斯·尤利乌斯·恺撒(拉丁文:Gaius Iulius Caesar,前100年7月12日-前44年3月15日),或译儒略·恺撒,罗马共和国末期的军事统帅、政治家,是罗马共和国体制转向罗马帝国的关键人物,史
  • 酮体酮体(Ketone bodies)是在身体饥饿、禁食或某些病理状态(如糖尿病)下产生的一类化合物,它包括丙酮、乙酰乙酸和β-羟丁酸三种化合物,不过严格意义上来讲,β-羟丁酸是一种羟基酸,而非
  • 免疫功能低下免疫缺陷(英语:immunodeficiency)是指免疫系统抵抗传染病的能力失常或欠缺。免疫缺陷还可能降低肿瘤免疫监视功能。免疫缺陷多为继发性(secondary)免疫缺陷,不过也有些人生来就有
  • 亚甲基-咪唑啉结构· cytoplasm· biosynthetic process组氨酸解氨酶(英语:Histidine ammonia-lyase,或称为组氨酸氨裂解酶或组氨酸酶)在人体中是一种由HAL基因编码的酶。组氨酸解氨酶将组氨酸转
  • 小米椒小米辣(学名:Capsicum frutescens)又名小米椒、鸡嘴椒、辣虎等,为茄科辣椒属的植物。分布在印度、欧洲、南美以及中国大陆的云南等地。本种可能是普通辣椒(Capsicum annuum)的同物
  • 液压液压机械(英语:hydraulic machinery)是通过流体力学原理增大机械力量的设备和工具,可应用于液压钳、手推液压叉车等小型工具,也可应用于一些重型设备中。以重型设备为例,液压液在
  • 楔形文字“KI”(U+121A0
  • 变分学变分法是处理泛函的数学领域,和处理函数的普通微积分相对。譬如,这样的泛函可以通过未知函数的积分和它的导数来构造。变分法最终寻求的是极值函数:它们使得泛函取得极大或极小