机器学习 06 scikit-learn 数据集介绍

在这里插入图片描述
案例用到的数据来源于scikit-learn

获取数据集
sklearn.datasets

		加载获取流行数据集
		
		**datasets.load_*()**
		
		获取小规模数据集,数据包含在datasets里
		
		**datasets.fetch_*(data_home=None)**
		
		获取大规模数据集,需要从网络上下载,函数的第一个参数是

data_home,表示数据集下载的目录,默认是 ~/scikit_learn_data/
** sklearn数据集返回值介绍**

			load和fetch返回的数据类型datasets.base.Bunch(字典格式)
			
			data:特征数据数组,是 [n_samples * n_features] 的二维 numpy.ndarray 数组
			
			target:标签数组,是 n_samples 的一维 numpy.ndarray 数组
			
			DESCR:数据描述
			
			feature_names:特征名,新闻数据,手写数字、回归数据集没有
			
			target_names:标签名

猜你喜欢

转载自blog.csdn.net/singularity1980/article/details/89672548