最小二乘法求回归直线方程的推导过程

最小二乘法求回归直线方程的推导过程在数据的统计分析中,数据之间即变量x与Y之间的相关性研究非常重要,通过在直角坐标系中做散点图的方式我们会发现很多统计数据近似一条直线,它们之间或者正相关或者负相关。虽然这些数据是离散的,不是连续的,我们无法得到一个确定的描述这种相关性的函数方程,但既然在直角坐标系中数据分布接近一条直线,那么我们就可以通过画直线的方式得到一个近似的描述这种关系的直线方程。当然,从前面的描述中不难看出,所有数据都分布

大家好,又见面了,我是你们的朋友全栈君。

 在数据的统计分析中,数据之间即变量x与Y之间的相关性研究非常重要,通过在直角坐标系中做散点图的方式我们会发现很多统计数据近似一条直线,它们之间或者
正相关或者
负相关。虽然这些数据是离散的,不是连续的,我们无法得到一个确定的描述这种相关性的函数方程,但既然在直角坐标系中数据分布接近一条直线,那么我们就可以通过画直线的方式得到一个近似的描述这种关系的直线方程。当然,从前面的描述中不难看出,所有数据都分布在一条直线附近,因此这样的直线可以画出很多条,而我们希望找出其中的一条,能够最好地反映变量之间的关系。换言之,我们要找出一条直线,使这条直线“最贴近”已知的数据点,设此直线方程为:


最小二乘法求回归直线方程的推导过程

这里的
最小二乘法求回归直线方程的推导过程是为了区分Y的实际值y(这里的实际值就是统计数据的真实值,我们称之为
观察值),当x取值
最小二乘法求回归直线方程的推导过程(i=1,2,3……n)时,Y的观察值为
最小二乘法求回归直线方程的推导过程,近似值为
最小二乘法求回归直线方程的推导过程(或者说对应
最小二乘法求回归直线方程的推导过程的纵坐标是
最小二乘法求回归直线方程的推导过程)。

其中
最小二乘法求回归直线方程的推导过程式叫做Y对x的回归直线方程,b叫做回归系数。要想确定回归直线方程
最小二乘法求回归直线方程的推导过程,我们只需确定a与回归系数b即可。

 设x,Y的一组观察值为:


最小二乘法求回归直线方程的推导过程   i = 1,2,3……n

其回归直线方程为:


最小二乘法求回归直线方程的推导过程

当x取值
最小二乘法求回归直线方程的推导过程(i=1,2,3……n)时,Y的观察值为
最小二乘法求回归直线方程的推导过程,差
最小二乘法求回归直线方程的推导过程刻画了实际观察值
最小二乘法求回归直线方程的推导过程与回归直线上相应点纵坐标之间的偏离程度,见下图:


最小二乘法求回归直线方程的推导过程

 实际上我们希望这n个离差构成的总离差越小越好,只有如此才能使直线最贴近已知点。换句话说,我们求回归直线方程的过程其实就是求离差最小值的过程。

一个很自然的想法是把各个离差加起来作为总离差。可是,由于离差有正有负,直接相加会互相抵消,如此就无法反映这些数据的贴近程度,即这个总离差不能用n个离差之和来表示,见下图:


最小二乘法求回归直线方程的推导过程

 

一般做法是我们用离差的平方和,即:


最小二乘法求回归直线方程的推导过程

作为总离差 ,并使之达到最小。这样回归直线就是所有直线中Q取最小值的那一条。由于平方又叫二乘方,所以这种使“离差平方和为最小”的方法,叫做
最小二乘法

用最小二乘法求回归直线方程中的a、b的公式如下:


最小二乘法求回归直线方程的推导过程

其中,
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程的均值,a、b的上方加“
︿”表示是由观察值按最小二乘法求得的估计值,a、b求出后,回归直线方程也就建立起来了。

当然,我们肯定不能满足于直接得到公式,我们只有理解这个公式怎么来的才能记住它,用好它,因此给出上面两个公式的推导过程更加重要。在给出上述公式的推导过程之前,我们先给出推导过程中用到的两个关键变形公式的推导过程。首先是第一个公式:

 
最小二乘法求回归直线方程的推导过程

 

接着是第二个公式:


最小二乘法求回归直线方程的推导过程

 

 基本变形公式准备完毕,我们可以开始最小二乘法求回归直线方程公式的推导了:


最小二乘法求回归直线方程的推导过程


最小二乘法求回归直线方程的推导过程

 

 至此,公式变形部分结束,从最终式子我们可以看到后两项


最小二乘法求回归直线方程的推导过程

与a、b无关,属于常数项,我们只需


最小二乘法求回归直线方程的推导过程

即可得到最小的Q值,因此:


最小二乘法求回归直线方程的推导过程

至此,公式推导完毕。

 

最小二乘法求回归直线方程可用于所有数据分布近似直线的数据统计、分析问题,其用程序实现非常简便,属于基础统计分析算法,必须能够熟练掌握应用。

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/145610.html原文链接:https://javaforall.net

(0)
全栈程序员-站长的头像全栈程序员-站长


相关推荐

  • 软件著作权的源代码_软件著作权源码被泄露

    软件著作权的源代码_软件著作权源码被泄露packagecom.example.shuoya;importjava.util.Set;importandroid.content.BroadcastReceiver;importandroid.content.Context;importandroid.content.Intent;importandroid.database.Cursor;importandroid.data…

    2022年9月22日
    0
  • php7 502 bad gateway,502 bad gateway怎么解决

    php7 502 bad gateway,502 bad gateway怎么解决502BadGateway错误是HTTP状态代码,表示Internet上的一台服务器收到来自另一台服务器的无效响应。在前面的文章中,已经给大家详细介绍了502badgateway是什么意思以及出现这种错误的一些原因总结。那么我们怎么解决502badgateway错误?502BadGateway错误通常是互联网上服务器之间的网络错误,也或者因为您的计算机或互联网连接出现问题。所以我们…

    2022年6月24日
    25
  • var let const作用域_实例变量用什么声明

    var let const作用域_实例变量用什么声明读《全局作用域中,用const和let声明的变量去哪了?》

    2022年4月21日
    51
  • pycharm整理格式快捷键_python代码对齐快捷键

    pycharm整理格式快捷键_python代码对齐快捷键格式化代码快捷键:ctrl+alt+L常用快捷键编辑类:Ctrl+D复制选定的区域或行Ctrl+Y删除选定的行Ctrl+Alt+L代码格式化Ctrl+Alt+O优化导入(去掉用不到的包导入)Ctrl+鼠标简介/进入代码定义Ctrl+/行注释、取消注释Ctrl+左方括号快速跳到代码开头Ctrl+右方括号快速跳到代码末尾Shift

    2022年8月28日
    1
  • 在WIN7系统的笔记本上建立WIFI热点「建议收藏」

    在WIN7系统的笔记本上建立WIFI热点

    2022年1月21日
    82
  • 支付风控模型

    支付风控模型支付风控数据仓库建设 。支付风控涉及到多方面的内容,包括反洗钱、反欺诈、客户风险等级分类管理等。其中最核心的功能在于对实时交易进行风险评估,或者说是欺诈检测。如果这个交易的风险太高,则会执行拦截。由于反欺诈检测是在交易时实时进行的,在要求不能误拦截的同时,还有用户体验上的要求,即不能占用太多时间,一般要求风控操作必须控制在100ms以内,对于交易量大的业务,10ms甚至更低的性能要求都是必须的。

    2022年4月29日
    83

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号