iris数据集数据处理

简介: iris数据集数据处理

iris数据集数据处理

iris数据集共有150个样本,目标变量为花的类别其都属于鸢尾属下的三个亚属(target),分别是山鸢尾 (Iris-setosa),变色鸢尾(Iris-versicolor)和维吉尼亚鸢尾(Iris-virginica)。

 

四个特征,分别是花萼长度(sepal length)、花萼宽度(sepal width)、花瓣长度(petal length)、花瓣宽度(petal width)。

 

1.1 导入函数

1 import numpy as np

2 import pandas as pd

3 import matplotlib.pyplot as plt

4 import seaborn as sns

 

1.2 导入数据

1 from sklearn.datasets import load_iris

2 data = load_iris()

3 iris_target = data.target

4 iris_features = pd.DataFrame(data=data.data, columns=data.feature_names) #利用Pandas转化为DataFrame格式

1.3 简单数据查看

1 ## 查看数据的整体信息

2 iris_features.info()

 3

4 ## 查看每个类别数量

5 pd.Series(iris_target).value_counts()

  image.png

## 查看head或tail

iris_features.head()

#iris_features.tail()

  image.png

## 对于特征进行一些统计描述

iris_features.describe()

 

image.png

目录
相关文章
|
机器学习/深度学习 数据处理 Python
【机器学习5】数据处理(二)Pandas:表格处理 2
【机器学习5】数据处理(二)Pandas:表格处理
284 0
|
8月前
|
数据采集 监控 安全
数据预处理
【2月更文挑战第25天】
|
2月前
|
数据挖掘 数据格式 Python
《Python数据分析实战:利用Pandas处理大规模数据集》
《Python数据分析实战:利用Pandas处理大规模数据集》
87 1
|
5月前
|
存储 数据挖掘 API
多快好省地使用pandas分析大型数据集
多快好省地使用pandas分析大型数据集
65 1
|
6月前
|
数据采集 数据挖掘 数据处理
如何用pandas处理数据集?
如何用pandas处理数据集?【7月更文挑战第8天】
70 0
|
8月前
|
数据处理
iris数据集数据处理
iris数据集数据处理
|
8月前
|
数据可视化 算法 数据挖掘
R语言鸢尾花iris数据集的层次聚类分析
R语言鸢尾花iris数据集的层次聚类分析
|
8月前
|
数据采集 Python
利用Pandas对小费数据集进行数据预处理实战(附源码)
利用Pandas对小费数据集进行数据预处理实战(附源码)
308 0
|
机器学习/深度学习 数据挖掘 数据处理
【机器学习5】数据处理(二)Pandas:表格处理 1
【机器学习5】数据处理(二)Pandas:表格处理
91 0
|
分布式计算 大数据 Hadoop
大数据预处理
大数据预处理
129 0