博客
关于我
《机器学习与实践》读书笔记及代码(三)
阅读量:146 次
发布时间:2019-02-27

本文共 2260 字,大约阅读时间需要 7 分钟。

#波士顿地区,用线性回归,去预测房价from sklearn.datasets import load_bostonboston = load_boston()print boston.DESCRfrom sklearn.cross_validation import train_test_splitimport numpy as npX = boston.datay = boston.target#如果没有这里的话,下一步会报错# X.shapeX_train, X_test, y_train, y_test = train_test_split(X,y,random_state=33,test_size = 0.25)print"The max target value is:",np.max(boston.target)print"The min target value is:",np.min(boston.target)print"The average target value is:",np.mean(boston.target)# print X_train.shape# print y_train.shape#从上面当中,显然发现预测目标房价之间,差距很大,因此,应该先标准化处理from sklearn.preprocessing import StandardScalerss_X = StandardScaler()#分别对训练和测试数据的特征,以及目标值进行标准化处理X_train = ss_X.fit_transform(X_train)X_test = ss_X.transform(X_test)ss_y = StandardScaler()#这里一定要有reshape(-1,1)这样一个过程,否则会报错,y_train = ss_y.fit_transform(y_train.reshape(-1, 1))y_test = ss_y.transform(y_test.reshape(-1, 1))#此处使用十分简单的LinearRegression和SGDRegression分别对美国波士顿地区的房价进行预测from sklearn.linear_model import LinearRegressionlr = LinearRegression()lr.fit(X_train,y_train)lr_y_predict = lr.predict(X_test)from sklearn.linear_model import SGDRegressorsgdr = SGDRegressor()sgdr.fit(X_train,y_train)sgdr_y_predict = sgdr.predict(X_test)#使用LinearRegression模型自带的评估模块。并输出结果print 'The value of default measurement of LinearRegression is:',lr.score(X_test,y_test)from sklearn.metrics import r2_score,mean_squared_error,mean_absolute_errorprint 'The value of R-squared of LinearRegression is:',r2_score(y_test,lr_y_predict)print 'The mean squared error of LinearRegression is:',mean_squared_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(lr_y_predict))print 'The mean absolute error of LinearRegression is:',mean_absolute_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(lr_y_predict))#使用SGDRegression模型自带的评估模块。并输出结果print 'The value of default measurement of SGDRegressor is:',sgdr.score(X_test,y_test)print 'The value of R-squared of LinearRegression is:',r2_score(y_test,sgdr_y_predict)print 'The mean squared error of LinearRegression is:',mean_squared_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(sgdr_y_predict))print 'The mean absolute error of LinearRegression is:',mean_absolute_error(ss_y.inverse_transform(y_test),ss_y.inverse_transform(sgdr_y_predict))

支持向量机(回归)

 

转载地址:http://ixjb.baihongyu.com/

你可能感兴趣的文章
Nginx配置ssl实现https
查看>>
Nginx配置TCP代理指南
查看>>
Nginx配置——不记录指定文件类型日志
查看>>
nginx配置一、二级域名、多域名对应(api接口、前端网站、后台管理网站)
查看>>
Nginx配置代理解决本地html进行ajax请求接口跨域问题
查看>>
nginx配置全解
查看>>
Nginx配置参数中文说明
查看>>
nginx配置域名和ip同时访问、开放多端口
查看>>
Nginx配置好ssl,但$_SERVER[‘HTTPS‘]取不到值
查看>>
Nginx配置如何一键生成
查看>>
Nginx配置实例-负载均衡实例:平均访问多台服务器
查看>>
Nginx配置文件nginx.conf中文详解(总结)
查看>>
Nginx配置负载均衡到后台网关集群
查看>>
ngrok | 内网穿透,支持 HTTPS、国内访问、静态域名
查看>>
NHibernate学习[1]
查看>>
NHibernate异常:No persister for的解决办法
查看>>
NIFI1.21.0_Mysql到Mysql增量CDC同步中_日期类型_以及null数据同步处理补充---大数据之Nifi工作笔记0057
查看>>
NIFI1.21.0_NIFI和hadoop蹦了_200G集群磁盘又满了_Jps看不到进程了_Unable to write in /tmp. Aborting----大数据之Nifi工作笔记0052
查看>>
NIFI1.21.0通过Postgresql11的CDC逻辑复制槽实现_指定表多表增量同步_增删改数据分发及删除数据实时同步_通过分页解决变更记录过大问题_02----大数据之Nifi工作笔记0054
查看>>
NIFI从MySql中增量同步数据_通过Mysql的binlog功能_实时同步mysql数据_根据binlog实现数据实时delete同步_实际操作04---大数据之Nifi工作笔记0043
查看>>