使用随机森林进行特征选择的具体方法 - 代码天地

使用随机森林进行特征选择的具体方法

其他 2018-08-20 21:25:37 阅读次数: 0

import numpy as np
import pandas as pd
from sklearn import svm
#from sklearn.linear_model import LogisticRegression


#——————————————————导入训练数据——————————————————————
data0 = pd.read_csv('Data22.csv',index_col=None,parse_dates = True) #pd.read_csv默认生成DataFrame对象
data1 = data0.iloc[:-227,-1].values[:,np.newaxis]#错位一天，以前一天来预测后一天
data2 =data0.iloc[227:,2:8].values  #取第2-9列
data = np.concatenate((data1,data2),axis=1)

train_x=data[:,:6]
train_y=data[:,6]

import matplotlib.pyplot as plt

feature_names=['ex_Value','Season','IsHoliday','DW','Weather','Temperature']

X=train_x[:288*30]#30天的数据
Y=train_y[:288*30]

from sklearn.cross_validation import cross_val_score, ShuffleSplit
from sklearn.ensemble import RandomForestRegressor

#Load boston housing dataset as an example

names = feature_names

rf = RandomForestRegressor(n_estimators=100, max_depth=4)
scores = []
for i in range(X.shape[1]):
     score = cross_val_score(rf, X[:, i:i+1], Y, scoring="r2",
                              cv=ShuffleSplit(len(X), 3, .3))
     scores.append((round(np.mean(score), 3), names[i]))
print(sorted(scores, reverse=True))

[(0.708, 'ex_Value'), (0.138, 'Temperature'), (0.124, 'Weather'), (0.02, 'DW'), (0.018, 'IsHoliday'), (-0.0, 'Season')]

180天，特征相关性检测：[(0.736, ‘ex_Value’), (0.162, ‘Temperature’), (0.103, ‘Season’), (0.031, ‘Weather’), (0.009, ‘IsHoliday’), (0.001, ‘DW’)]

7天，特征相关性检测：[(0.888, ‘ex_Value’), (-0.001, ‘Season’), (-0.002, ‘Temperature’), (-0.003, ‘Weather’), (-0.004, ‘DW’), (-0.006, ‘IsHoliday’)]

30天，特征相关性检测：[(0.716, ‘ex_Value’), (0.13, ‘Temperature’), (0.124, ‘Weather’), (0.023, ‘DW’), (0.02, ‘IsHoliday’), (-0.001, ‘Season’)]

360天特征相关性检测：[(0.747, ‘ex_Value’), (0.102, ‘Temperature’), (0.037, ‘Season’), (0.021, ‘Weather’), (0.005, ‘IsHoliday’), (0.001, ‘DW’)]

1天，特征相关性检测：[(0.919, ‘ex_Value’), (0.101, ‘Weather’), (0.085, ‘Temperature’), (0.057, ‘DW’), (-0.005, ‘Season’), (-0.02, ‘IsHoliday’)]

猜你喜欢

转载自blog.csdn.net/elite666/article/details/80696228

使用随机森林进行特征选择的具体方法

随机森林进行特征选择

利用随机森林进行特征选择

利用随机森林来进行特征选择（Python代码实现）

随机森林特征选择

React中使用swiper的具体方法

angular 引入echarts的具体方法及使用

特征工程-使用随机森林进行缺失值填补

ambari安装使用MySQL数据库的具体方法

软件调试的具体方法

特征选择-随机森林可以衡量特征的重要程度

利用随机森林对特征重要性进行评估方法一

使用随机森林计算特征重要度

随机森林算法OOB_SCORE最佳特征选择

利用随机森林对特征重要性进行评估

FANUC机器人进行负载设定和负载推算的具体方法

FANUC机器人作为从站进行TCP/IP以太网通讯的具体方法

springboot整合freemarker的具体方法及案例

聚类学习（2）——具体方法

图片局部识别具体方法

vr全景拍摄的具体方法

.NET Core 环境下使用命令行移除某个 nuget 包的具体方法

Java使用ZipInputStream类(简单)解压缩文件，具体方法如下：

使用xgboost进行特征选择

使用RFE进行特征选择

使用Boruta进行特征选择

随机森林参数选择

Google Earth Engine（GEE）——使用随机森林方法进行土地分类（农作物）

GEE python:使用随机森林方法进行土地分类和精度评定

Python学习8---文件操作具体方法（1）

今日推荐

基于大语言模型的开源知识库问答系统 MaxKB GitHub Star 数量突破 5,000 个！

美国拟限制 AI 大模型出口中国和俄罗斯

苹果将与 OpenAI 达成协议，将 ChatGPT 应用于 iPhone

openKylin 社区生态委员会第六次会议圆满召开

阿里云正式发布通义千问 2.5

Python 3.13 发布首个 Beta：实验性自由线程模式和 JIT、改进交互式解释器

Stack Overflow 拿我的代码去训练 AI 大模型，还封了我的账号

Pop!_OS 的 COSMIC 桌面完成 App Store 上架工作

《2024 年一季度互联网投融资运行情况》研究报告

报告：Django 仍然是 74% 开发者的首选

15 年前上了“FFmpeg 耻辱柱”，今天他还得谢谢咱——腾讯QQPlayer一雪前耻？

TIOBE 5 月榜单：Fortran “复活”进入 Top 10

周排行

记一下去大梅沙的准备（2018-05-26）

Spring 注解事务

基于HTTP协议的客户端缓存

阿里云rds 备份和还原

[PHP] 几个拖慢 PHP 程序/API 运行速度的点

python 代码风格------------PEP8规则

js控制json生成菜单——自制菜单（一）

将字符串: 'k:1|k1:2|k2:3|k3:4 ' ,处理成 python 字典: {'k':1, 'k1':2, ...}

微信小程序转支付宝小程序

Qt551.窗口滚动条

每日归档

更多

2024-05-13(18)

2024-05-12(0)

2024-05-11(38)

2024-05-10(38)

2024-05-09(35)

2024-05-08(42)

2024-05-07(14)

2024-05-06(40)

2024-05-05(0)

2024-05-04(7)