標籤:內建 取出 http 分享圖片 sklearn 技術分享 技術 nump 不同
1. 安裝scipy,numpy,sklearn包
2. 從sklearn包內建的資料集中讀出鳶尾花資料集data
3.查看data類型,包含哪些資料
#載入numpy包import numpy#載入sklearn包from sklearn.datasets import load_iris #讀出鳶尾花資料集datadata=load_iris()#查看data類型print(type(data))#查看資料內容print(data.keys())
運行結果如下:
4.取出鳶尾花特徵和鳶尾花類別資料,查看其形狀及資料類型
#鳶尾花的四個特徵data_feature= data.feature_namesiris_data=data.dataprint(data_feature)print(iris_data)#鳶尾花的三個類別data_target =data.target_namesprint(data_target)iris_data=data.targetprint(iris_data)#資料類型type(iris_data)
運行結果如下:
5.取出所有花的花萼長度(cm)的資料
#鳶尾花花萼長度的資料sepal_length=numpy.array(list(len[0] for len in data[‘data‘]))print(sepal_length)
運行結果如下:
6.取出所有花的花瓣長度(cm)+花瓣寬度(cm)的資料
#鳶尾花花瓣長度的資料petal_length=numpy.array(list(len[2] for len in data[‘data‘])) print(petal_length)
#鳶尾花花瓣寬度的資料petal_width=numpy.array(list(len[3] for len in data[‘data‘])) print(petal_width)
運行結果如下:
7.取出某朵花的四個特徵及其類別
#取出某朵花的四個特徵print(data.data[0])#取出某朵花的類別print(data.target_names[0])
運行結果如下:
8.將所有花的特徵和類別分成三組,每組50個
9.產生新的數組,每個元素包含四個特徵+類別
#定義三個列表來存放不同類型花朵的類別setosa_data = []versicolor_data = []virginica_data = []#for i in range(0,150): #產生為setosa類的鳶尾花花資料 if data.target[i] == 0: data1 = data.data[i].tolist() data1.append(‘setosa‘) setosa_data.append(data1) #產生為versicolor類的鳶尾花資料 elif data.target[i] == 1: data1 = data.data[i].tolist() data1.append(‘versicolor‘) versicolor_data.append(data1) #剩下的為virginica類的鳶尾花資料 else: data1 = data.data[i].tolist() data1.append(‘virginica‘) virginica_data.append(data1)#產生新的數組,每個元素包含四個特徵+類別newdata=(setosa_data ,versicolor_data,virginica_data)print(newdata)
運行結果如下:
numpy資料集練習