分布
1.泊松分布
例如:某医院平均每小时出生3个婴儿
1.1特点
它们的特点就是,我们可以预估这些事件的总数,但是没法知道具体的发生时间。已知平均每小时出生3个婴儿,请问下一个小时,会出生几个?有可能一下子出生6个,也有可能一个都不出生。这是我们没法知道的。
泊松分布就是描述某段时间内,事件具体的发生概率。
上面就是泊松分布的公式。等号的左边,P 表示概率,N表示某种函数关系,t 表示时间,n 表示数量,1小时内出生3个婴儿的概率,就表示为 P(N(1) = 3) 。等号的右边,λ 表示事件的频率。
(1)接下来两个小时,一个婴儿都不出生的概率是0.25%,基本不可能发生。
(2)接下来一个小时,至少出生两个婴儿的概率是80%。
2.指数分布
指数分布是事件的时间间隔的概率。下面这些都属于指数分布。
- 婴儿出生的时间间隔
- 来电的时间间隔
- 奶粉销售的时间间隔
- 网站访问的时间间隔
指数分布的公式可以从泊松分布推断出来。如果下一个婴儿要间隔时间 t ,就等同于 t 之内没有任何婴儿出生。
反过来,事件在时间 t 之内发生的概率,就是1减去上面的值。
(1)接下来15分钟,会有婴儿出生的概率是52.76%。
(2)接下来的15分钟到30分钟,会有婴儿出生的概率是24.92%。
3.总结
一句话总结:泊松分布是单位时间内独立事件发生次数的概率分布,指数分布是独立事件的时间间隔的概率分布。
请注意是"独立事件",泊松分布和指数分布的前提是,事件之间不能有关联,否则就不能运用上面的公式。
4.正态分布
正态分布又名高斯分布(Gaussian distribution)
假设一随机变量X服从一个期望为μ,方差为σ2的正态分布,概率密度函数为:
f
(
x
)
=
1
2
σ
e
−
(
x
−
μ
)
2
2
σ
2
f(x)=\frac{1}{\sqrt{2}\sigma}e^{-\frac{(x-\mu)^{2}}{2\sigma^{2}}}
f(x)=2σ1e−2σ2(x−μ)2
测可记作:X~N(
μ
,
σ
2
\mu,\sigma^{2}
μ,σ2):
4.参考链接
1.https://nbviewer.jupyter.org/github/nicolewhite/notebooks/blob/master/Poisson.ipynb
2.http://www.ruanyifeng.com/blog/2015/06/poisson-distribution.html