科百科
当前位置: 首页 科技资讯

利用excel回归分析(一文学会如何用Excel做回归分析)

时间:2023-05-23 作者: 小编 阅读量: 4 栏目名: 科技资讯

如预测具体目标是下一年度的销售量,那么销售量Y就是因变量。通过市场调查和查阅资料,寻找与预测目标的相关影响因素,即自变量,并从中选出主要的影响因素。进行相关分析,一般要求出相关关系,以相关系数的大小来判断自变量和因变量的相关的程度。回归方程只有通过各种检验,且预测误差较小,才能将回归方程作为预测模型进行预测。5.计算并确定预测值利用回归预测模型计算预测值,并对预测值进行综合分析,确定最后的预测值。

一、什么是回归分析法

“回归分析”是解析“注目变量”和“因于变量”并明确两者关系的统计方法。此时,我们把因子变量称为“说明变量”,把注目变量称为“目标变量址(被说明变量)”。

清楚了回归分析的目的后,下面我们以回归分析预测法的步骤来说明什么是回归分析法:

1.根据预测目标,确定自变量和因变量明确预测的具体目标,也就确定了因变量。如预测具体目标是下一年度的销售量,那么销售量Y就是因变量。通过市场调查和查阅资料,寻找与预测目标的相关影响因素,即自变量,并从中选出主要的影响因素。

2.建立回归预测模型依据自变量和因变量的历史统计资料进行计算,在此基础上建立回归分析方程,即回归分析预测模型。

3.进行相关分析什么是回归分析法回归分析是对具有因果关系的影响因素(自变量)和预测对象(因变量)所进行的数理统计分析处理。只有当变量与因变量确实存在某种关系时,建立的回归方程才有意义。因此,作为自变量的因素与作为因变量的预测对象是否有关,相关程度如何,以及判断这种相关程度的把握性多大,就成为进行回归分析必须要解决的问题。进行相关分析,一般要求出相关关系,以相关系数的大小来判断自变量和因变量的相关的程度。

4.检验回归预测模型,计算预测误差回归预测模型是否可用于实际预测,取决于对回归预测模型的检验和对预测误差的计算。回归方程只有通过各种检验,且预测误差较小,才能将回归方程作为预测模型进行预测。

5.计算并确定预测值利用回归预测模型计算预测值,并对预测值进行综合分析,确定最后的预测值。

二回归分析的目的

回归分析的目的大致可分为两种:

第一,“预测”。

预测目标变量,求解目标变量y和说明变量(x1,x2,…)的方程。

y=a0 b1x1 b2x2 … bkxk 误差(方程A)

把方程A叫做(多元)回归方程或者(多元)回归模型。a0是y截距,b1,b2,…,bk是回归系数。当k=l时,只有1个说明变量,叫做一元回归方程。根据最小平方法求解最小误差平方和,非求出y截距和回归系数。若求解回归方程.分別代入x1,x2,…xk的数值,预测y的值。

第二,“因子分析”。

因子分析是根据回归分析结果,得出各个自变量对目标变量产生的影响,因此,需要求出各个自变量的影响程度。

希望初学者在阅读接下来的文章之前,首先学习一元回归分析、相关分析、多元回归分析、数量化理论I等知识。

根据最小平方法,使用Excel求解y=a bx中的a和b。那么什么是最小平方法?

分别从散点图的各个数据标记点,做一条平行于y轴的平行线,相交于图中直线(如下图)

平行线的长度在统计学中叫做“误差”或者‘残差”。误差(残差)是指分析结果的运算值和实际值之间的差。

接这,求平行线长度曲平方值。可以把平方值看做边长等于平行线长度的正方形面积(如下图)

最后,求解所有正方形面积之和。确定使面积之和最小的a(截距)和b(回归系数)的值(如下图)。

使用Excel求解回归方程;“工具”→“数据分析”→“回归”,具体操作步骤将在后面的文章中具体会说明。

三、回归分析案例

接着上节的回归分析的目的,我们来根据一个二手车的实例来继续说回归分析。

二手车价格的决定因素有:空调类型有无附加品(TV导航导航SR、天窗、空气囊LD TV AW) 行驶距离,颜色车检剩余有效月数、评分拍卖会地点等。

在这14个因子(说明变量)中,最影响价格(目标变量)的是什么?最不影响价格的是什么?通过定量求出影响度,然后根据多个因子(说明变量)预测二手车价格(目标变量)。

可以用方程2表示。二手车价格“这个目标变量数据,既(“空调类型(AC WC)” “有无TV导航”、 、“行驶距离”、 。车检剩余有效月数”, “评分”)。

混合模型

混台模型是指因子巾既包含定性数据也包含定量数据的模型。在混台模型中.把“空调”、 “TV导航”等定性因子叫做项目,把数据群(空调的“AC”,“WAC”,TV导航的“有”、“无”)叫做类别。

接下来,根据表l进行回归分析。

这节我们主要告诉大家回归分析前,我们需要先根据自己的思维来了解分析,把这些需要注意的先分析出来,这样对我们接下来的回归分析有很大的帮助。

四、Excel回归分析需要注意的事项

经过上节,我们了解了回归分析前,我们要先通过思维分析出来需要注意的事项,那么今天接着上一节的课来了解下Excel回归分析需要注意的事项。包含的定性数据,不能直接使用Excel分析,需要将其转换成虚拟变量(也叫O,1数据)。例如, “空调(AC、WAC)”的数据,“AC”用“1”,“WAC"用“O”表示。同样地,“导航(有导航、无导航)”的数据, “有导航”用“1”, “无导航”用“O”表示。表1是根据这种方法转换的(0,1)数据表。

直接使用Excel的对表1进行回归分析时,运算结果不理想。理由如下;

表1

以“导航”为例,各行

“有导航” “无导航”=1

此式成立。把公式变形,

“有导航”=1-“无导航”

所以“有导航”是“0”或是“1”,由“无导航。自动决定。

线性代数中发生秩(矩阵秩)亏时,不能正确求出必要的逆矩阵。因此也不能求出回归系数。

由于上述原因,进行回归分析时,需要从各个项目中删除—列因子(表2)。

表2

根据表2的数据进行回归分析,操作步骤如下:

1、“工具”一“数据分析”

2、在弹出的“数据分析”对话框中选择“回归”,单击“确定”(图1)。

图13、点击“回归”对话框的“Y值输入区域”,选择“二手车价格”的列数据,包括项目名称;接着点击“X值输入区域”,选择从“AC”到“中国、四国、九州”的区域,包括项目名称;选中。标志”,单击“确定”。(图2)

图2系统弹出错误信息,不能进行回归分析(图3)。这是因为Excel回归自由度的最大上限是16(P62小知识)。这里的回归自由度是22,因此不能进行回归分析。

图3

统计学中经常出现“自由度”,即有效信息的数量。

前面已经提到,在Excel的回归分析中,回归自由度的最大上限是16。回归自由度在(多重)回归分析、数量化理论|、混合模型中具有不同意义。表3是对回归自由度的不同意义的总结。

表3

五、分两次进行回归分析

我们在前面提到过,当回归自由度在17以上时,Excel无法进行回归分析,那么就需要分两次进行回归分析。第一次,把“空调”、“TV导航”、“导航”、“SR”、“天窗”、“空气囊”、“LD”、“TV”、“AW”作为说明变量(表1),第二次,把“颜色”、“拍卖会地点”、“行驶距离”、“车检剩余有效月数”、“评分”作为说明变量(表2),目标变量都是“二手车价格”。

表1

表2对表1、表2进行回归分析。回归分析的结果分别如表3、表4所示(具体操作步骤将在下一节详细说明)。

表3

表4

内容来源:Excel学习网

【灯塔大数据】微信公众号介绍:中国电信北京研究院通过大数据技术创新,自主研发了业内领先的“灯塔”大数据行业应用创新平台,灯塔面向市场研究、广告营销、商业地理、金融征信、人力资源等诸多行业领域,提供零售研究、消费者研究、店铺选址、精准营销、泛义征信,背景调查等服务,助力企业在大数据时代扬帆远航。

微信公众号【灯塔大数据】关键字回复信息:

回复【云计算产业趋势分析】 下载分析报告PPT

回复【高峰论坛】 根据编号下载高峰论坛PPT资料

回复【主论坛】 查看《中国电信灯塔大数据高峰论坛》视频回放

回复【技术论坛】 收看技术分论坛视频回放

回复【推荐系统】 下载程序代码

回复【 灯塔 】 查看更多关键字回复下载

    推荐阅读
  • 卡卡退役后还会看足球吗(卡卡随基普乔格跑完柏林全马)

    在9月25日进行的2022柏林马拉松赛上,37岁的肯尼亚名将基普乔格以2小时1分9秒的成绩夺冠,并创造了全新的世界纪录。后半程,卡卡的速度有所下降,但最终以3小时38分06秒完赛的成绩,在业余马拉松选手中还是算相当不错的。而且,这次卡卡参加柏林马拉松也有为父亲打气、鼓劲的原因。2016年镇江马拉松,李铁又以1小时45分的成绩完成半马比赛。

  • 学校预防新冠肺炎防控知识(复课防控小知识)

    对其它地区返校师生要做好体温监测及症状筛查。高校应设置集中隔离医学观察区,对来自或经停湖北以及疫情高发地区的师生和被判定为密切接触者进行集中医学观察。要配合辖区疾病预防控制中心做好疑似或确诊病例的流行病学调查、密切接触者排查。在辖区疾病预防控制中心和中小学卫生保健科的工作人员指导下进行消毒。所使用消毒剂应在有效期内。

  • 按部就班造句(按部就班造句一年级)

    7、即使是您认为应该按部就班,直截了当的技术决策,也会有政治参杂其中,特别是您处于决定是否批准购买某企业工具的职位。

  • 15分钟快速退烧(我娃快速退烧)

    我娃快速退烧昨天晚上10点半才回家,刚回到家里,老人家就说,娃发烧了,我赶紧到房里看娃,发现他还在被窝里打冷战急忙用手探他额头,哇!挺烫的,问他哪里不舒服?头疼头晕发热发冷������,用探热针测出来事38.9℃。

  • 产后怎么缩阴效果好

    运动法阴道本身有一定的修复功能,产后出现的扩张现象在产后3个月即可恢复。产后妈妈可以通过一些锻炼来加强弹性的恢复,促进阴道紧实。练习骨盆运动女人半蹲,两膝微屈,两足分开60厘米左右,两手叉腰。吸气,将骨盆前推;呼气,将骨盆拉回,同时臀部尽量向后撅起。练习展腿运动女人运动躯干、大腿时,腹压作用于阴道,产生快感,同时阴道口开张,利于局部气血通畅。女人坐姿,两手后撑,左腿屈立,右腿屈膝外展,平放垫上。

  • 手机新浪微博怎么取消关注(手机新浪微博如何取消关注)

    以下内容希望对你有帮助!手机新浪微博怎么取消关注打开新浪微博手机客户端,点击页面底部“我”菜单,在展开的页面中,点击“关注”选项。打开微博账号当前关注的用户之后,点击“关注的人”菜单按钮。接下来,可以看到当前已经关注的用户,想要取消关注的话,点击“已关注”按钮,在弹出的对话框中,点击“确定”按钮即可。

  • 广州人口(广州的介绍)

    广州人口广州人口数量:1530.59万人。广州是首批国家历史文化名城,广府文化的发祥地,从秦朝开始一直是郡治、州治、府治的所在地,华南地区的政治、军事、经济、文化和科教中心。广州被全球权威机构GaWC评为世界一线城市,每年举办的中国进出口商品交易会吸引了大量客商以及大量外资企业、世界500强企业的投资,国家高新技术企业达8700多家,总量居全国前三,集结了全省80%的高校、70%的科技人员,在校大学生总量居全国第一。

  • 夏天的租房市场(北京租房夏理银)

    2012年2月,女儿参加“国考”被录取到了国家机关。7月,接通知到单位报到上班。也就是说,租户与房东并无直接联系。我们签订的租期为一年,中介先收一个月的房租即3600元为中介费,另外还要一次性地交付“押二付三”的费用。所谓“押二付三”,就是将两个月的房租作为押金,另预付三个月的房租。如果合同到期双方无什么纠纷时则押金退回。合同签订后我们和中介按合同上的内容对室内设施进行查看清点,完毕后中介将钥匙交付我们。

  • 麻酱秋葵的做法凉拌(简单版凉拌(麻酱秋葵的做法)

    以下内容大家不妨参考一二希望能帮到您!麻酱秋葵的做法凉拌原料:秋葵、橄榄油、盐、芝麻酱、大蒜。秋葵洗干净入煮锅焯水后捞出沥干水。大蒜碎放入碗中加盐。加橄榄油搅拌均匀成芝麻酱汁。秋葵放入盘中,添加芝麻酱汁,稍加搅拌即可享用。

  • 稍的拼音和组词(稍的拼音和组词是怎样的)

    稍的拼音和组词稍的拼音和组词:稍许、稍微、稍纵即逝、稍稍、稍麦、脱稍、手稍、稍地、花稍、枝稍、稍伯、秩稍、稍芟、稍房、稍子、稍麻寺、稍属、眼稍、稍杀、稍问、四稍、稍黩筐篚、稍安勿躁、稍倾、上稍、俸稍、稍麄胆壮、稍长胆壮、乡稍、稍迁、拉稍寺、头稍自领、竿稍、稍绿、稍挽稍、稍侵、饩稍、稍天、奉稍、没下稍。稍有shāo和shào两种读音。作shāo时本义为禾末,引申为略微。作shào时〔~息〕军事或体操的口令。