最小二乘法求回归直线方程的推导过程

最小二乘法求回归直线方程的推导过程在数据的统计分析中,数据之间即变量x与Y之间的相关性研究非常重要,通过在直角坐标系中做散点图的方式我们会发现很多统计数据近似一条直线,它们之间或者正相关或者负相关。虽然这些数据是离散的,不是连续的,我们无法得到一个确定的描述这种相关性的函数方程,但既然在直角坐标系中数据分布接近一条直线,那么我们就可以通过画直线的方式得到一个近似的描述这种关系的直线方程。当然,从前面的描述中不难看出,所有数据都分布

大家好,又见面了,我是你们的朋友全栈君。

 在数据的统计分析中,数据之间即变量x与Y之间的相关性研究非常重要,通过在直角坐标系中做散点图的方式我们会发现很多统计数据近似一条直线,它们之间或者
正相关或者
负相关。虽然这些数据是离散的,不是连续的,我们无法得到一个确定的描述这种相关性的函数方程,但既然在直角坐标系中数据分布接近一条直线,那么我们就可以通过画直线的方式得到一个近似的描述这种关系的直线方程。当然,从前面的描述中不难看出,所有数据都分布在一条直线附近,因此这样的直线可以画出很多条,而我们希望找出其中的一条,能够最好地反映变量之间的关系。换言之,我们要找出一条直线,使这条直线“最贴近”已知的数据点,设此直线方程为:


最小二乘法求回归直线方程的推导过程

这里的
最小二乘法求回归直线方程的推导过程是为了区分Y的实际值y(这里的实际值就是统计数据的真实值,我们称之为
观察值),当x取值
最小二乘法求回归直线方程的推导过程(i=1,2,3……n)时,Y的观察值为
最小二乘法求回归直线方程的推导过程,近似值为
最小二乘法求回归直线方程的推导过程(或者说对应
最小二乘法求回归直线方程的推导过程的纵坐标是
最小二乘法求回归直线方程的推导过程)。

其中
最小二乘法求回归直线方程的推导过程式叫做Y对x的回归直线方程,b叫做回归系数。要想确定回归直线方程
最小二乘法求回归直线方程的推导过程,我们只需确定a与回归系数b即可。

 设x,Y的一组观察值为:


最小二乘法求回归直线方程的推导过程   i = 1,2,3……n

其回归直线方程为:


最小二乘法求回归直线方程的推导过程

当x取值
最小二乘法求回归直线方程的推导过程(i=1,2,3……n)时,Y的观察值为
最小二乘法求回归直线方程的推导过程,差
最小二乘法求回归直线方程的推导过程刻画了实际观察值
最小二乘法求回归直线方程的推导过程与回归直线上相应点纵坐标之间的偏离程度,见下图:


最小二乘法求回归直线方程的推导过程

 实际上我们希望这n个离差构成的总离差越小越好,只有如此才能使直线最贴近已知点。换句话说,我们求回归直线方程的过程其实就是求离差最小值的过程。

一个很自然的想法是把各个离差加起来作为总离差。可是,由于离差有正有负,直接相加会互相抵消,如此就无法反映这些数据的贴近程度,即这个总离差不能用n个离差之和来表示,见下图:


最小二乘法求回归直线方程的推导过程

 

一般做法是我们用离差的平方和,即:


最小二乘法求回归直线方程的推导过程

作为总离差 ,并使之达到最小。这样回归直线就是所有直线中Q取最小值的那一条。由于平方又叫二乘方,所以这种使“离差平方和为最小”的方法,叫做
最小二乘法

用最小二乘法求回归直线方程中的a、b的公式如下:


最小二乘法求回归直线方程的推导过程

其中,
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程
最小二乘法求回归直线方程的推导过程的均值,a、b的上方加“
︿”表示是由观察值按最小二乘法求得的估计值,a、b求出后,回归直线方程也就建立起来了。

当然,我们肯定不能满足于直接得到公式,我们只有理解这个公式怎么来的才能记住它,用好它,因此给出上面两个公式的推导过程更加重要。在给出上述公式的推导过程之前,我们先给出推导过程中用到的两个关键变形公式的推导过程。首先是第一个公式:

 
最小二乘法求回归直线方程的推导过程

 

接着是第二个公式:


最小二乘法求回归直线方程的推导过程

 

 基本变形公式准备完毕,我们可以开始最小二乘法求回归直线方程公式的推导了:


最小二乘法求回归直线方程的推导过程


最小二乘法求回归直线方程的推导过程

 

 至此,公式变形部分结束,从最终式子我们可以看到后两项


最小二乘法求回归直线方程的推导过程

与a、b无关,属于常数项,我们只需


最小二乘法求回归直线方程的推导过程

即可得到最小的Q值,因此:


最小二乘法求回归直线方程的推导过程

至此,公式推导完毕。

 

最小二乘法求回归直线方程可用于所有数据分布近似直线的数据统计、分析问题,其用程序实现非常简便,属于基础统计分析算法,必须能够熟练掌握应用。

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/145610.html原文链接:https://javaforall.net

(0)
上一篇 2022年5月16日 下午11:40
下一篇 2022年5月16日 下午11:40


相关推荐

  • JRTPLIB_刘伯温传简介

    JRTPLIB_刘伯温传简介jrtplib是一个基于C++、面向对象的RTP封装库,最新的版本是3.9.1(2011年11月)。为了与RFC3550相兼容,3.x.x版本经过完全重写,现在它提供了一些非常有用的组件,这些组件为构建各种各样的RTP应用程序开发提供了有用的帮助。较旧的2.x版本依然可用,但是不兼容RFC3550。1.特性    jrtplib支持定义于RFC3550中的RTP协议,它使得发送和接

    2022年7月28日
    5
  • java设计模式3,里氏替换原则

    java设计模式3,里氏替换原则里氏替换原则的内容可以描述为:“派生类(子类)对象可以在程序中代替其基类(超类)对象。”

    2025年7月3日
    6
  • python入门教程(非常详细)-python入门(非常详细的教程)

    python入门教程(非常详细)-python入门(非常详细的教程)对于初学者而言 您要做的只是专注于 Python 语言 阐明学习重点 掌握学习节奏 并逐步学习 根据我多年的学习和工作经验 编程语言的学习分为以下三个步骤 无论您是否具有编程基础 都可以通过比较来完成 1 多练习多积累代码任何编程语言都具有广泛的知识 从基本变量赋值 条件循环到文件操作 并发编程等 但是 不要等到学习了所有知识点后再开始练习 因为到那时会发现您已经忘记了难以记住的知识 学习编程非常实用

    2026年3月26日
    0
  • linux编辑文本(vim)时跳转到最后一行和第一行及相关指令

    linux编辑文本(vim)时跳转到最后一行和第一行及相关指令

    2022年2月8日
    81
  • Linux安装Anaconda3过程详解

    Linux安装Anaconda3过程详解担心自己也忘记 所以顺便记录一下 当然 也方便大家也学会 Linux 安装 Anaconda 环境说明 Linux 腾讯云下的 CentOS7 6Anaconda 版本 Anaconda3 5 2 01 下载 1 1 去清华镜像站下载 上传到云端服务器上清华镜像站 https mirrors tuna tsinghua edu cn anaconda archive 下载的版本见下 下载 64 位的 Linux 版本上传到 Linux 上 我选择的路径为 usr local Anaconda 1

    2026年3月16日
    2
  • 微信开放平台—-微信扫码登录

    微信开放平台—-微信扫码登录告知:所有操作是基于域名已备案,并且具有企业级微信公众号!1.准备工作   1.1.注册微信开放平台帐号       https://open.weixin.qq.com   1.2.创建应用(网站应用),填写资料https://open.weixin.qq.com/cgi-bin/appcreate?t=manage/createWeb&type=…

    2022年6月11日
    57

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号