我们从2011年坚守至今,只想做存粹的技术论坛。  由于网站在外面,点击附件后要很长世间才弹出下载,请耐心等待,勿重复点击不要用Edge和IE浏览器下载,否则提示不安全下载不了

 找回密码
 立即注册
搜索
查看: 2634|回复: 5

[IT/数码] 为什么数据科学家都钟情于最常见的正态分布?

[复制链接]
  • TA的每日心情

    11 小时前
  • 签到天数: 106 天

    [LV.6]常住居民II

    3万

    主题

    8260

    回帖

    8万

    积分

    三级逆天

    积分
    81512

    终身成就奖特殊贡献奖原创先锋奖金点子奖优秀斑竹奖宣传大使奖

    发表于 2018-6-18 21:20:56 | 显示全部楼层 |阅读模式

    马上注册,结交更多好友,享用更多功能,让你轻松玩转社区

    您需要 登录 才可以下载或查看,没有账号?立即注册

    ×
    对于深度学习和机器学习工程师们来说,正态分布是世界上所有概率模型中最重要的一个。即使你没有参与过任何人工智能项目,也一定遇到过高斯模型,今天就让我们来看看高斯过程为什么这么受欢迎。
      高斯分布(Gaussian distribution),也称正态分布,最早由A.棣莫弗在求二项分布的渐近公式中得到。C.F.高斯在研究测量误差时从另一个角度导出了它。P.S.拉普拉斯和高斯研究了它的性质。是一个在数学、物理及工程等领域都非常重要的概率分布,在统计学的许多方面有着重大的影响力。
      正态曲线呈钟型,两头低,中间高,左右对称因其曲线呈钟形,因此人们又经常称之为钟形曲线。

                                   
    登录/注册后可看大图
      若随机变量X服从一个数学期望为μ、方差为σ^2的正态分布,记为N(μ,σ^2)。其概率密度函数为正态分布的期望值μ决定了其位置,其标准差σ决定了分布的幅度。当μ = 0,σ = 1时的正态分布是标准正态分布。

                                   
    登录/注册后可看大图
      高斯概率分布的数学表达式
      在自然现象中随处可见
    [blockquote]
      所有模型都是错的,但有些是有用的
      —George Box
    [/blockquote]

                                   
    登录/注册后可看大图
      正在扩散的粒子的位置可以用正态分布来描述
      正态分布有极其广泛的实际背景,生产与科学实验中很多随机变量的概率分布都可以近似地用正态分布来描述。例如,在生产条件不变的情况下,产品的强力、抗压强度、口径、长度等指标;同一种生物体的身长、体重等指标;同一种种子的重量;测量同一物体的误差;弹着点沿某一方向的偏差;某个地区的年降水量;以及理想气体分子的速度分量,等等。
      一般来说,如果一个量是由许多微小的独立随机因素影响的结果,那么就可以认为这个量具有正态分布。从理论上看,正态分布具有很多良好的性质,许多概率分布可以用它来近似;还有一些常用的概率分布是由它直接导出的,例如对数正态分布、t分布、F分布等。
      数学原因:中心极限定理

                                   
    登录/注册后可看大图
      二维空间上进行200万步的随机游走之后得到的图案
      中心极限定理的内容为:大量独立随机变量的和经过适当标准化之后趋近于正态分布,与这些变量原本的分布无关。比如,随机游走的总距离就趋近于正态分布。下面我们介绍三种形式的中心极限定理:
    独立同分布的中心极限定理
      设随机变量X1,X2,......Xn,......独立同分布,并且具有有限的数学期望和方差:E(Xi)=μ,D(Xi)=σ^2 (i=1,2....),则对任意x,分布函数为

                                   
    登录/注册后可看大图
      满足

                                   
    登录/注册后可看大图
      该定理说明,当n很大时,随机变量
      近似地服从标准正态分布N(0,1)。因此,当n很大时,
      近似地服从正态分布N(nμ,nσ^2).该定理是中心极限定理最简单又最常用的一种形式,在实际工作中,只要n足够大,便可以把独立同分布的随机变量之和当作正态变量。这种方法在数理统计中用得很普遍,当处理大样本时,它是重要工具。
    棣莫佛-拉普拉斯定理
      设随机变量X(n=1,2,...,)服从参数为n,p(0<p<1)的二项分布,则对于任意有限区间(a,b)有

                                   
    登录/注册后可看大图
      该定理表明,正态分布是二项分布的极限分布,当数充分大时,我们可以利用上式来计算二项分布的概率。
    不同分布的中心极限定理
      设随机变量X1,X2,......Xn,......独立同分布,它们的概率密度分别为fxk(x),并有E(Xk)=μk,D(Xk)= σk^2,(k=1,2......)

                                   
    登录/注册后可看大图
      若对任意正数τ,有:

                                   
    登录/注册后可看大图
      对任意x,随机变量Yn的分布函数Fn(x),满足:
      该定理说明:所研究的随机变量如果是有大量独立的而且均匀的随机变量相加而成,那么它的分布将近似于正态分布。
    万变不离其宗
      与其他很多分布不同,正态分布进行适当的变换之后,仍是正态分布。
      两个正态分布之积仍是正态分布
      两个独立的服从正态分布的随机变量之和服从正态分布
      对一个正态分布进行高斯卷积还是正态分布
      正态分布经过傅立叶变换之后仍是正态分布
      简洁

                                   
    登录/注册后可看大图
      奥卡姆剃刀强调一个哲学原则:在其他条件都相同下,最简单的解就是最好的解。
      对于任何一个用正态分布拟合的随机分布,都可能存在一个多参数,更复杂,更准确的解法。但是我们仍然会倾向于选用正态分布,因为它在数学上很简洁。
      它的均值(mean)、中值(median)和众数(mode)都相同
      只需要用两个参数就可以确定整个分布
    图形特性:
      集中性:正态曲线的高峰位于正中央,即均数所在的位置。
      对称性:正态曲线以均数为中心,左右对称,曲线两端永远不与横轴相交。
      均匀变动性:正态曲线由均数所在处开始,分别向左右两侧逐渐均匀下降。
      曲线与横轴间的面积总等于1,相当于概率密度函数的函数从正无穷到负无穷积分的概率为1。即频率的总和为100%。
    回复

    使用道具 举报

  • TA的每日心情
    开心
    2024-11-13 11:07
  • 签到天数: 19 天

    [LV.4]偶尔看看III

    0

    主题

    4303

    回帖

    4135

    积分

    二级逆天

    积分
    4135

    终身成就奖优秀斑竹奖特殊贡献奖原创先锋奖

    QQ
    发表于 2018-6-19 00:16:05 | 显示全部楼层
    回复

    使用道具 举报

    该用户从未签到

    18

    主题

    1087

    回帖

    2196

    积分

    二级逆天

    积分
    2196

    终身成就奖金点子奖优秀斑竹奖

    QQ
    发表于 2018-6-19 08:43:56 | 显示全部楼层
    回复

    使用道具 举报

    该用户从未签到

    0

    主题

    1619

    回帖

    745

    积分

    二级逆天

    积分
    745

    终身成就奖优秀斑竹奖

    QQ
    发表于 2018-6-19 09:13:03 | 显示全部楼层
    回复

    使用道具 举报

  • TA的每日心情
    开心
    昨天 21:24
  • 签到天数: 60 天

    [LV.6]常住居民II

    2

    主题

    1万

    回帖

    2万

    积分

    三级逆天

    积分
    20585

    终身成就奖特殊贡献奖原创先锋奖优秀斑竹奖

    QQ
    发表于 2018-6-20 08:28:40 | 显示全部楼层
    回复

    使用道具 举报

  • TA的每日心情
    开心
    2024-8-2 17:14
  • 签到天数: 1 天

    [LV.1]初来乍到

    477

    主题

    4723

    回帖

    1万

    积分

    三级逆天

    积分
    10001

    社区居民社区劳模忠实会员原创达人终身成就奖优秀斑竹奖

    QQ
    发表于 2018-6-20 08:29:35 | 显示全部楼层
    回复

    使用道具 举报

    您需要登录后才可以回帖 登录 | 立即注册

    本版积分规则

    每日签到,有金币领取。


    Copyright ©2011-2024 NTpcb.com All Right Reserved.  Powered by Discuz! (NTpcb)

    本站信息均由会员发表,不代表NTpcb立场,如侵犯了您的权利请发帖投诉

    ( 闽ICP备2024076463号-1 ) 论坛技术支持QQ群171867948 ,论坛问题,充值问题请联系QQ1308068381

    平平安安
    TOP
    快速回复 返回顶部 返回列表