机器学习 06 scikit-learn 数据集介绍

机器学习 06 scikit-learn 数据集介绍_第1张图片
案例用到的数据来源于scikit-learn

获取数据集
sklearn.datasets

加载获取流行数据集

datasets.load_*()

获取小规模数据集,数据包含在datasets里

datasets.fetch_*(data_home=None)

获取大规模数据集,需要从网络上下载,函数的第一个参数是

data_home,表示数据集下载的目录,默认是 ~/scikit_learn_data/
** sklearn数据集返回值介绍**

load和fetch返回的数据类型datasets.base.Bunch(字典格式)

data:特征数据数组,是 [n_samples * n_features] 的二维 numpy.ndarray 数组

target:标签数组,是 n_samples 的一维 numpy.ndarray 数组

DESCR:数据描述

feature_names:特征名,新闻数据,手写数字、回归数据集没有

target_names:标签名

你可能感兴趣的:(机器学习 06 scikit-learn 数据集介绍)