我们应该求解只使用对目标变量真正产生影响的因子的回归方程。这是因为如果使用对目标变量不产生影响的因子,可能导致预测精确度降低。如果因子很少,求解的变量也就很少。这样,统计的变景数据很少,就可以节省时间,在实际应用中非常有效。在统计学上,仅仅使用产生影响的因子的方程叫做“最优回归方程”,或者“最优回归模型”。
求最优回归方程的步骤如下:
最优回归方程是当Ru是正数且数值最大时的组合。
接下来,说明实际操作步骤。
1、进行回归分析后,把表1的分析结果(1、2、3)代入回归方程,计算因子选择标准(Ru)为0.72l。
表1
2、接着,进行因子分析,结果如图1所示。从图1可知。影响度绝对值最小的因于是“拍卖会地点”。因此,删除所有拍卖会地点的附属项目 (“东京”、“关东(不古东京)” 、“东海”、 “近畿”、 “中国、四国、九州”)。
图1
3、对表2进行回归分析
表2
表2的目归分析结果,如表3所示。
表3
4、根据表3.得出Ru是0.726.然后以此进行因子分析,其结果如表4所示,可知影响度绝对值最小的是“AW”。
比较Excel中数据的相对大小
我们在使用Excel表格的时候,有时为了在工作表的单元格中更加直观地观察比较Excel中数据的相对大小,可以使用Excel数据条来设置单元格格式,原始数据与数据条效果对比如图1和图2所示。 图1 图2 设置数据条的方法很简单,首先选择数据区域,单击“开始”选项卡,在“样式&r
表4
把表4制成Excel柱形图,如图2所示。
图2
5、删除影响度数值最小的“AW”,再次进行回归分析。
重复操作直到目于减少为1个。这里省略对操作步骤的说明。
到目前为止。共计运行了8次回归分析。下面求8次运行结果的Ru值,并统计到表5中。
表5
把表5转换成折线图,如图3所示。
图3
使因子选择标准Ru最大的组台,就是最优回归方程。从表3 25得知,当因子数是7个时,可得最优回归方程。
因此,根据表3得出最优回归方程:
方程1
根据方程1求最高价格:
y=267.58 46.99 23.59 45.74-241.94十(-3.41)*40 6.99*22 86.30*4.5=991.60’)
用同样的方法求最低价格:
y=267.58 0 O 0 0 (-3.41)*65 6.99*0 86.30×3.5=347.98"
我们的求最优回归方程和前面的几节教程是相互联系的,大家在学习的时候要从前到后的学习,这样才可以学会的。
Excel文本型数字和纯数字的格式转换
文本型数字与纯数字的格式统一处理及转换。是很多人容易忽视的问题。例如:在某列输入文本型数字产品编号的同时又输入了纯数字产品编号。这样的后果就是会对数据统计与分析造成很大影响。甚至得不到正确的结果。因此,在处理数字和文本型数字时要特别小心。今天我们来学习下Excel文本型数字和纯数字的格式转换。 一、将纯数字转换为文