机器学习之路：python 集成回归模型随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归预测波士顿房价

python3 学习机器学习api

使用了三种集成回归模型

git: https://github.com/linyi0604/MachineLearning

代码：

 from sklearn.datasets import load_boston

 from sklearn.cross_validation import train_test_split

 from sklearn.preprocessing import StandardScaler

 from sklearn.ensemble import RandomForestRegressor, ExtraTreesRegressor, GradientBoostingRegressor

 from sklearn.metrics import r2_score, mean_squared_error, mean_absolute_error

 import numpy as np

 '''

 随机森林回归

 极端随机森林回归

 梯度提升回归

 通常集成模型能够取得非常好的表现

 '''

 # 1 准备数据

 # 读取波士顿地区房价信息

 boston = load_boston()

 # 查看数据描述

 # print(boston.DESCR)   # 共506条波士顿地区房价信息，每条13项数值特征描述和目标房价

 # 查看数据的差异情况

 # print("最大房价：", np.max(boston.target))   # 50

 # print("最小房价：",np.min(boston.target))    # 5

 # print("平均房价：", np.mean(boston.target))   # 22.532806324110677

 x = boston.data

 y = boston.target

 # 2 分割训练数据和测试数据

 # 随机采样25%作为测试 75%作为训练

 x_train, x_test, y_train, y_test = train_test_split(x, y, test_size=0.25, random_state=33)

 # 3 训练数据和测试数据进行标准化处理

 ss_x = StandardScaler()

 x_train = ss_x.fit_transform(x_train)

 x_test = ss_x.transform(x_test)

 ss_y = StandardScaler()

 y_train = ss_y.fit_transform(y_train.reshape(-1, 1))

 y_test = ss_y.transform(y_test.reshape(-1, 1))

 # 4 三种集成回归模型进行训练和预测

 # 随机森林回归

 rfr = RandomForestRegressor()

 # 训练

 rfr.fit(x_train, y_train)

 # 预测 保存预测结果

 rfr_y_predict = rfr.predict(x_test)

 # 极端随机森林回归

 etr = ExtraTreesRegressor()

 # 训练

 etr.fit(x_train, y_train)

 # 预测 保存预测结果

 etr_y_predict = rfr.predict(x_test)

 # 梯度提升回归

 gbr = GradientBoostingRegressor()

 # 训练

 gbr.fit(x_train, y_train)

 # 预测 保存预测结果

 gbr_y_predict = rfr.predict(x_test)

 # 5 模型评估

 # 随机森林回归模型评估

 print("随机森林回归的默认评估值为：", rfr.score(x_test, y_test))

 print("随机森林回归的R_squared值为：", r2_score(y_test, rfr_y_predict))

 print("随机森林回归的均方误差为:", mean_squared_error(ss_y.inverse_transform(y_test),

                                           ss_y.inverse_transform(rfr_y_predict)))

 print("随机森林回归的平均绝对误差为:", mean_absolute_error(ss_y.inverse_transform(y_test),

                                              ss_y.inverse_transform(rfr_y_predict)))

 # 极端随机森林回归模型评估

 print("极端随机森林回归的默认评估值为：", etr.score(x_test, y_test))

 print("极端随机森林回归的R_squared值为：", r2_score(y_test, gbr_y_predict))

 print("极端随机森林回归的均方误差为:", mean_squared_error(ss_y.inverse_transform(y_test),

                                             ss_y.inverse_transform(gbr_y_predict)))

 print("极端随机森林回归的平均绝对误差为:", mean_absolute_error(ss_y.inverse_transform(y_test),

                                                ss_y.inverse_transform(gbr_y_predict)))

 # 梯度提升回归模型评估

 print("梯度提升回归回归的默认评估值为：", gbr.score(x_test, y_test))

 print("梯度提升回归回归的R_squared值为：", r2_score(y_test, etr_y_predict))

 print("梯度提升回归回归的均方误差为:", mean_squared_error(ss_y.inverse_transform(y_test),

                                             ss_y.inverse_transform(etr_y_predict)))

 print("梯度提升回归回归的平均绝对误差为:", mean_absolute_error(ss_y.inverse_transform(y_test),

                                                ss_y.inverse_transform(etr_y_predict)))

 '''

 随机森林回归的默认评估值为： 0.8391590262557747

 随机森林回归的R_squared值为： 0.8391590262557747

 随机森林回归的均方误差为: 12.471817322834646

 随机森林回归的平均绝对误差为: 2.4255118110236227

 极端随机森林回归的默认评估值为： 0.783339502805047

 极端随机森林回归的R_squared值为： 0.8391590262557747

 极端随机森林回归的均方误差为: 12.471817322834646

 极端随机森林回归的平均绝对误差为: 2.4255118110236227

 GradientBoostingRegressor回归的默认评估值为： 0.8431187344932869

 GradientBoostingRegressor回归的R_squared值为： 0.8391590262557747

 GradientBoostingRegressor回归的均方误差为: 12.471817322834646

 GradientBoostingRegressor回归的平均绝对误差为: 2.4255118110236227

 '''

机器学习之路：python 集成回归模型随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归预测波士顿房价的更多相关文章

机器学习之路: python 线性回归LinearRegression, 随机参数回归SGDRegressor 预测波士顿房价
python3学习使用api 线性回归,和随机参数回归 git: https://github.com/linyi0604/MachineLearning from sklearn.datasets ...
机器学习之路：python k近邻回归预测波士顿房价
python3 学习机器学习api 使用两种k近邻回归模型分别是平均k近邻回归和距离加权k近邻回归进行预测 git: https://github.com/linyi0604/Machine ...
机器学习之路: python 回归树 DecisionTreeRegressor 预测波士顿房价
python3 学习api的使用 git: https://github.com/linyi0604/MachineLearning 代码: from sklearn.datasets import ...
机器学习之路: python k近邻分类器 KNeighborsClassifier 鸢尾花分类预测
使用python语言学习k近邻分类器的api 欢迎来到我的git查看源代码: https://github.com/linyi0604/MachineLearning from sklearn.da ...
机器学习之路: python 决策树分类DecisionTreeClassifier 预测泰坦尼克号乘客是否幸存
使用python3 学习了决策树分类器的api 涉及到特征的提取,数据类型保留,分类类型抽取出来新的类型需要网上下载数据集,我把他们下载到了本地, 可以到我的git下载代码和数据集: https: ...
机器学习之路--Python
常用数据结构 1.list 列表有序集合 classmates = ['Michael', 'Bob', 'Tracy'] len(classmates) classmates[0] len(cla ...
吴裕雄 python 机器学习——集成学习AdaBoost算法回归模型
import numpy as np import matplotlib.pyplot as plt from sklearn import datasets,ensemble from sklear ...
Poisson回归模型
Poisson回归模型也是用来分析列联表和分类数据的一种方法,它实际上也是对数线性模型的一种,不同点是对数线性模型假定频数分布为多项式分布,而泊松回归模型假定频数分布为泊松分布. 首先我们来认识一下泊 ...
吴裕雄 python 机器学习——集成学习随机森林RandomForestRegressor回归模型
import numpy as np import matplotlib.pyplot as plt from sklearn import datasets,ensemble from sklear ...

随机推荐

EOJ Monthly 2019.2 (based on February Selection) D.进制转换
题目链接: https://acm.ecnu.edu.cn/contest/140/problem/D/ 题目: 思路: 我们知道一个数在某一个进制k下末尾零的个数x就是这个数整除kx,这题要求刚好末 ...
HDU 5701 中位数计数（思维题）
题目链接 Problem Description 中位数定义为所有值从小到大排序后排在正中间的那个数,如果值有偶数个,通常取最中间的两个数值的平均数作为中位数. 现在有n个数,每个数都是独一无二的,求 ...
Sql Server 逻辑文件 '' 不是数据库 '' 的一部分。请使用 RESTORE FILELISTONLY 来列出逻辑文件名。
当使用语句还原数据库时,报如下错误: 消息 3234,级别 16,状态 2,第 29 行逻辑文件 'LenborMealOrder_Base_2017' 不是数据库 'Members_01' 的一部分 ...
transform动画效果
transform动画效果 transform :移动,旋转.倾斜.缩放. transform:translate(0,300px); x代表的是水平的偏移距离,y代表垂直的. t ...
[转]双线性插值（Bilinear interpolation）
1,原理在图像的仿射变换中,很多地方需要用到插值运算,常见的插值运算包括最邻近插值,双线性插值,双三次插值,兰索思插值等方法,OpenCV提供了很多方法,其中,双线性插值由于折中的插值效果和运算速度 ...
如何使用vs2012单步调试uGUI（unity3d 5.3f4）
下载uGUI源代码 uGUI源代码地址:https://bitbucket.org/Unity-Technologies/ui 下载代码工具:tortoisehg-3.6.2-x64.msi http ...
[Android Studio] Android Studio如何快速生成get，set，tostring，构造函数
刚开始使用Android Studio时,在创建一个javabean时,很习惯的在JavaBean类中,右键去找生成get,set等选项.但是很遗憾,找不到. 那这边如何快速的set,get或者生成构 ...
IPv4的核心管理功能/proc/sys/net/ipv4/*
I /proc/sys/net/ipv4/tcp_syncookies SYN Cookies模块可以在系统随机端口(1024:65535)即将用完时自动启动,用来应对Dos攻击.当启动SYN Coo ...
group by 和 distinct 去重比较
distinct方式就是两两对比,需要遍历整个表.group by分组类似先建立索引再查索引,所以两者对比,小表destinct快,不用建索引.大表group by快.一般来说小表就算建索引,也不会慢 ...
Django API验证（令牌）
1. 获取接口信息 Client端 import requests import time import hashlib ctime = time.time() key = 'akfljakfjakl ...

机器学习之路：python 集成回归模型 随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归 预测波士顿房价

机器学习之路：python 集成回归模型 随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归 预测波士顿房价的更多相关文章

随机推荐

热门专题

机器学习之路：python 集成回归模型随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归预测波士顿房价

机器学习之路：python 集成回归模型随机森林回归RandomForestRegressor 极端随机森林回归ExtraTreesRegressor GradientBoostingRegressor回归预测波士顿房价的更多相关文章