大数定律

8 minIntermediate2026/6/14

切比雪夫大数定律、伯努利大数定律、辛钦大数定律及其应用。

1. 大数定律的直观理解

大数定律表明:大量独立重复试验中,事件发生的频率稳定于其概率,随机变量的算术平均稳定于其期望

这是概率论的理论基础,也是统计推断的依据。

2. 切比雪夫大数定律

2.1 定理

X1,X2,X_1, X_2, \cdots 为相互独立的随机变量序列,若 E(Xi)=μiE(X_i) = \mu_iD(Xi)=σi2D(X_i) = \sigma_i^2 都存在,且方差一致有界,即存在 C>0C > 0 使得 σi2C\sigma_i^2 \leq Ci=1,2,i = 1, 2, \cdots),则对任意 ε>0\varepsilon > 0

limnP(1ni=1nXi1ni=1nμi<ε)=1\lim_{n \to \infty} P\left(\left|\frac{1}{n}\sum_{i=1}^n X_i - \frac{1}{n}\sum_{i=1}^n \mu_i\right| < \varepsilon\right) = 1

2.2 证明

Xˉn=1ni=1nXi\bar{X}_n = \dfrac{1}{n}\sum_{i=1}^n X_i,则

E(Xˉn)=1ni=1nμi,D(Xˉn)=1n2i=1nσi2CnE(\bar{X}_n) = \frac{1}{n}\sum_{i=1}^n \mu_i, \quad D(\bar{X}_n) = \frac{1}{n^2}\sum_{i=1}^n \sigma_i^2 \leq \frac{C}{n}

由切比雪夫不等式:

P(XˉnE(Xˉn)ε)D(Xˉn)ε2Cnε20(n)P(|\bar{X}_n - E(\bar{X}_n)| \geq \varepsilon) \leq \frac{D(\bar{X}_n)}{\varepsilon^2} \leq \frac{C}{n\varepsilon^2} \to 0 \quad (n \to \infty)

2.3 特殊情形

X1,X2,X_1, X_2, \cdots 独立同分布,E(Xi)=μE(X_i) = \muD(Xi)=σ2D(X_i) = \sigma^2,则

limnP(1ni=1nXiμ<ε)=1\lim_{n \to \infty} P\left(\left|\frac{1}{n}\sum_{i=1}^n X_i - \mu\right| < \varepsilon\right) = 1

XˉnPμ\bar{X}_n \xrightarrow{P} \mu

3. 伯努利大数定律

3.1 定理

nAn_Ann 次独立试验中事件 AA 发生的次数,pp 为每次试验中 AA 发生的概率,则对任意 ε>0\varepsilon > 0

limnP(nAnp<ε)=1\lim_{n \to \infty} P\left(\left|\frac{n_A}{n} - p\right| < \varepsilon\right) = 1

3.2 证明

XiX_i 为第 ii 次试验中 AA 是否发生的指示变量,则 nA=i=1nXin_A = \sum_{i=1}^n X_iXiB(1,p)X_i \sim B(1, p)

由切比雪夫大数定律(独立同分布情形)即得。

3.3 意义

伯努利大数定律表明:频率稳定于概率。这是用频率估计概率的理论依据。

4. 辛钦大数定律

4.1 定理

X1,X2,X_1, X_2, \cdots 为独立同分布的随机变量序列,若 E(Xi)=μE(X_i) = \mu 存在,则对任意 ε>0\varepsilon > 0

limnP(1ni=1nXiμ<ε)=1\lim_{n \to \infty} P\left(\left|\frac{1}{n}\sum_{i=1}^n X_i - \mu\right| < \varepsilon\right) = 1

4.2 与切比雪夫大数定律的区别

  • 切比雪夫大数定律要求方差存在且一致有界
  • 辛钦大数定律只要求期望存在,不要求方差存在
  • 辛钦大数定律要求独立同分布

4.3 辛钦大数定律的证明思路

利用特征函数的方法:设 XiX_i 的特征函数为 φ(t)\varphi(t),则 Xˉn\bar{X}_n 的特征函数为

φXˉn(t)=[φ(tn)]n\varphi_{\bar{X}_n}(t) = \left[\varphi\left(\frac{t}{n}\right)\right]^n

由于 φ(t)=1+iμt+o(t)\varphi(t) = 1 + i\mu t + o(t)t0t \to 0),故

φXˉn(t)=[1+iμtn+o(1n)]neiμt\varphi_{\bar{X}_n}(t) = \left[1 + \frac{i\mu t}{n} + o\left(\frac{1}{n}\right)\right]^n \to e^{i\mu t}

eiμte^{i\mu t} 是常数 μ\mu 的特征函数,由特征函数的连续性定理,XˉnPμ\bar{X}_n \xrightarrow{P} \mu

5. 收敛性的概念

5.1 依概率收敛

X1,X2,X_1, X_2, \cdots 为随机变量序列,XX 为随机变量,若对任意 ε>0\varepsilon > 0

limnP(XnX<ε)=1\lim_{n \to \infty} P(|X_n - X| < \varepsilon) = 1

则称 XnX_n 依概率收敛XX,记作 XnPXX_n \xrightarrow{P} X

5.2 几乎必然收敛

P(limnXn=X)=1P\left(\lim_{n \to \infty} X_n = X\right) = 1,则称 XnX_n 几乎必然收敛XX,记作 Xna.s.XX_n \xrightarrow{a.s.} X

5.3 收敛的关系

几乎必然收敛 \Rightarrow 依概率收敛,反之不成立。

大数定律中的收敛是依概率收敛(弱大数定律)或几乎必然收敛(强大数定律)。

6. 大数定律的应用

6.1 蒙特卡洛方法

E(g(X))=IE(g(X)) = I,由辛钦大数定律:

1ni=1ng(Xi)PI\frac{1}{n}\sum_{i=1}^n g(X_i) \xrightarrow{P} I

其中 X1,X2,X_1, X_2, \cdots 独立同分布。这就是蒙特卡洛积分的原理。

6.2 经验分布函数

Fn(x)=1ni=1nI(Xix)F_n(x) = \dfrac{1}{n}\sum_{i=1}^n I(X_i \leq x) 为经验分布函数,由伯努利大数定律:

Fn(x)PF(x)F_n(x) \xrightarrow{P} F(x)

6.3 统计推断的基础

大数定律保证了样本均值是总体均值的一致估计,这是参数估计的理论基础。