博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
岭回归与Lasso回归
阅读量:7058 次
发布时间:2019-06-28

本文共 608 字,大约阅读时间需要 2 分钟。

线性回归的一般形式

这里写图片描述


过拟合问题及其解决方法

    • 问题:以下面一张图片展示过拟合问题
      这里写图片描述
    • 解决方法:(1):丢弃一些对我们最终预测结果影响不大的特征,具体哪些特征需要丢弃可以通过PCA算法来实现;(2):使用正则化技术,保留所有特征,但是减少特征前面的参数θ的大小,具体就是修改线性回归中的损失函数形式即可,岭回归以及Lasso回归就是这么做的。

岭回归与Lasso回归


岭回归与Lasso回归的出现是为了解决线性回归出现的过拟合以及在通过正规方程方法求解θ的过程中出现的x转置乘以x不可逆这两类问题的,这两种回归均通过在损失函数中引入正则化项来达到目的,具体三者的损失函数对比见下图:

这里写图片描述
其中λ称为正则化参数,如果λ选取过大,会把所有参数θ均最小化,造成欠拟合,如果λ选取过小,会导致对过拟合问题解决不当,因此λ的选取是一个技术活。
岭回归与Lasso回归最大的区别在于岭回归引入的是L2范数惩罚项,Lasso回归引入的是L1范数惩罚项,Lasso回归能够使得损失函数中的许多θ均变成0,这点要优于岭回归,因为岭回归是要所有的θ均存在的,这样计算量Lasso回归将远远小于岭回归。
岭回归
这里写图片描述
可以看到,Lasso回归最终会趋于一条直线,原因就在于好多θ值已经均为0,而岭回归却有一定平滑度,因为所有的θ值均存在。

摘自:https://blog.csdn.net/hzw19920329/article/details/77200475

你可能感兴趣的文章
《R语言游戏数据分析与挖掘》一2.3 数据导入
查看>>
大数据推动、可持续运营 宁家骏谈新型智慧城市建设路径
查看>>
《算法技术手册》一2.3.1 最坏情况
查看>>
XTools CRM:从粗放大数据中提炼精确厚数据
查看>>
专业医疗仪器设备走入千家万户 安全引担忧
查看>>
不常见但是很有用的gcc命令行选项(二)
查看>>
闪存趋势可能导致用户回归硬盘
查看>>
未来物联网影响商业的三种表现
查看>>
降低大数据合规风险的三个要点
查看>>
100G及超100G数据中心光模块的技术选择
查看>>
如何整理磁盘碎片让Windows 7电脑运行更快?
查看>>
智能投影的“淘金热”
查看>>
红杉入股LIFX,智能你个灯泡
查看>>
微信小程序架构分析 (下)
查看>>
红帽Chris:软件定义带动开源存储发展
查看>>
如何设计未来的数据中心
查看>>
微软Surface Phone泄密:高通骁龙830芯片明年上市
查看>>
传日本NTT Data在竞购戴尔Perot Systems
查看>>
从追随到超越 本土电子测量仪器的“极限挑战”
查看>>
[原创]nginx写日志时机与tcp write写成功是否送达对端疑问解析
查看>>