位置: 编程技术 - 正文

Python scikit-learn 做线性回归的示例代码

编辑:rootadmin

推荐整理分享Python scikit-learn 做线性回归的示例代码,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

一、概述

机器学习算法在近几年大数据点燃的热火熏陶下已经变得被人所“熟知”,就算不懂得其中各算法理论,叫你喊上一两个著名算法的名字,你也能昂首挺胸脱口而出。当然了,算法之林虽大,但能者还是有限,能适应某些环境并取得较好效果的算法会脱颖而出,而表现平平者则被历史所淡忘。随着机器学习社区的发展和实践验证,这群脱颖而出者也逐渐被人所认可和青睐,同时获得了更多社区力量的支持、改进和推广。

以最广泛的分类算法为例,大致可以分为线性和非线性两大派别。线性算法有著名的逻辑回归、朴素贝叶斯、最大熵等,非线性算法有随机森林、决策树、神经网络、核机器等等。线性算法举的大旗是训练和预测的效率比较高,但最终效果对特征的依赖程度较高,需要数据在特征层面上是线性可分的。因此,使用线性算法需要在特征工程上下不少功夫,尽量对特征进行选择、变换或者组合等使得特征具有区分性。而非线性算法则牛逼点,可以建模复杂的分类面,从而能更好的拟合数据。

那在我们选择了特征的基础上,哪个机器学习算法能取得更好的效果呢?谁也不知道。实践是检验哪个好的不二标准。那难道要苦逼到写五六个机器学习的代码吗?No,机器学习社区的力量是强大的,码农界的共识是不重复造轮子!因此,对某些较为成熟的算法,总有某些优秀的库可以直接使用,省去了大伙调研的大部分时间。

基于目前使用python较多,而python界中远近闻名的机器学习库要数scikit-learn莫属了。这个库优点很多。简单易用,接口抽象得非常好,而且文档支持实在感人。本文中,我们可以封装其中的很多机器学习算法,然后进行一次性测试,从而便于分析取优。当然了,针对具体算法,超参调优也非常重要。

二、Scikit-learn的python实践

本篇文章利用线性回归算法预测波士顿的房价。波士顿房价数据集包含波士顿郊区住房价值的信息。

第一步:Python库导入

第二步:数据获取和理解

波士顿数据集是scikit-learn的内置数据集,可以直接拿来使用。

dict_keys([‘data', ‘target', ‘feature_names', ‘DESCR'])

(, )

Python scikit-learn 做线性回归的示例代码

[‘CRIM' ‘ZN' ‘INDUS' ‘CHAS' ‘NOX' ‘RM' ‘AGE' ‘DIS' ‘RAD' ‘TAX' ‘PTRATIO''B' ‘LSTAT']

结论:波士顿数据集个样本,个特征。

第三步:数据模型构建——线性回归

第四步:数据模型应用——预测房价

array([ ., . , . , ., .])

.

总结

1 使用.DESCR探索波士顿数据集,业务目标是预测波士顿郊区住房的房价;

2 使用scikit-learn针对整个数据集拟合线性回归模型,并计算均方误差。

思考环节

1 对数据集分割成训练数据集和测试数据集

2 训练数据集训练线性回归模型,利用线性回归模型对测试数据集进行预测

3 计算训练模型的MSE和测试数据集预测结果的MSE

4 绘制测试数据集的残差图

标签: Python scikit-learn 做线性回归的示例代码

本文链接地址:https://www.jiuchutong.com/biancheng/372141.html 转载请保留说明!

上一篇:Python定时器实例代码

下一篇:Python栈算法的实现与简单应用示例(python3 栈)

  • 工程款税率是多少专票
  • 工商年报的纳税总额是什么
  • 上个月的普票开错了怎么办
  • 现金流量表填报说明
  • 发票的抵扣期限怎么填
  • 申报成功忘记清关怎么办
  • 预授权撤销怎么撤销
  • 出售本月转入处置的固定资产应交税费
  • 转增股本是不是缴个人所得税
  • 施工机械保险费属于什么费用
  • 印花税少提了怎么办
  • 别人提供原材料加工后加工费
  • 如何办理临时经营纳税人设立登记
  • 支票入账怎么填写
  • 土地增值税怎么预交
  • 企业收到供货单位提供的材料
  • 银行支票怎么用
  • 用友t3怎么增加现金流量项目
  • win1020h2更新0x800f081f
  • 国库年终总结
  • 银行存款日期和起息日期不一样
  • 常见的dump抓取方法
  • PHP:mb_substr_count()的用法_mbstring函数
  • win10错误代码0xc0000001
  • 惠普2600打印机故障排除
  • 增值税中的筹划方法哪些可以应用在消费税中,为什么?
  • 城建税申报表怎么作废
  • 广告公司收到广告发票如何入账
  • 缅因州达马里斯科塔地区的佩马基德灯塔 (© Tom Whitney/Adobe Stock)
  • 企业股权转让所得可以弥补亏损吗
  • 税前弥补以前年度亏损分录
  • 房产前期开发
  • 半球形的谢尔亨里克森天文台,挪威斯瓦尔巴群岛 (© Vincent Fournier/Gallery Stock)
  • cpu占满gpu不工作
  • vue2.
  • 写字楼买卖办手续
  • 因果推断的常用标准
  • 原生js操作数组的方法
  • 会计审核费用报销单的职责
  • netconf over ssh
  • 资本化利息支出现金流量表计入哪里
  • 非税收入定额票据可以报销吗去什么地方报销
  • 财政总预算会计的主体是
  • 电子商务公司怎么做账比较合适
  • python repeat函数
  • 设计模式golang
  • 公司人员工资计算方法
  • 差旅费报销相关政策
  • 企业所得税的营业成本怎么填
  • 股本减少是利好吗
  • 长期待摊费用会计分录
  • 收到预收款并已付款
  • 高铁行程信息提示可以乘车吗
  • 收到损坏物品赔偿金如何入账
  • 行政单位年终奖的相关发放规定
  • 金蝶k3怎么打印科目余额表
  • 建筑业属于货物经营吗
  • 退回的附加税能退回来吗
  • 长期应收款是否计提坏账准备
  • 如何理解应收账款平均余额
  • 如何开启windows防火墙
  • mssecsvc是什么进程
  • 系统盘gpt转mbr
  • win7安装程序遇到错误0xc0000135
  • win8系统蓝屏后无法修复
  • opengl怎么学
  • perl -pi
  • js按照指定顺序排序
  • css 定位
  • shell脚本windows
  • javascript学习指南
  • html5 树形控件
  • jquery基本操作
  • android 屏幕适配方案
  • 怎样纳税申报和缴纳
  • 印花税没有做税种认定
  • 安徽省地方税务局公告2016年第1号
  • 临沂国税地税局领导班子
  • 税务局大厅咨询台
  • 淮安市地税局电话号码
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设