假设下面的七个点是原始数据,
- 不做中心化需要用 一维的线性回归:y=kx+b 拟合得到红线,红线更容易被一些离群点影响,而产生偏差,而绿线更稳定一些,因为绿线是通过固定点的直线
- 中心化之后,假设改为,y=kx ,只优化k就可以得到绿线。
- 当数据量很大时,这两条线会趋于平行,也就等价了,但是在小数据量的时候还是做中心化的效果更好一点。
基于以上几点对样本数据做中心化效果会更好,那去中心化 到底该怎么做呐? real=real-b,那b怎么求得呐?可以猜测比如电影评分1~5分,那么去中间值=b 可能效果会好一点。

本文探讨了一维线性回归中中心化与去中心化处理对拟合直线的影响。中心化后的线性回归简化为y=kx的形式,避免了参数b的优化,使模型更稳定,尤其在小数据集上表现更佳。文章还讨论了去中心化的具体实现方法。

7252

被折叠的 条评论
为什么被折叠?



