Python数据分析与展示:pandas算术和比较运算-11

简介: Python数据分析与展示:pandas算术和比较运算-11

算术运算法则

算术运算根据行列索引,补齐后运算,

运算默认产生浮点数 补齐时缺项填充NaN(空值)

二维和一维、一维和零维间为广播运算

采用+ ‐* /符号进行的二元运算产生新的对象

方法形式的运算

方法

说明

.add(d, **argws)

类型间加法运算,可选参数

.sub(d, **argws)

类型间减法运算,可选参数

.mul(d, **argws)

类型间乘法运算,可选参数

.div(d, **argws)

类型间除法运算,可选参数

比较运算法则

比较运算只能比较相同索引的元素,不进行补齐

二维和一维、一维和零维间为广播运算

采用> < >= <= == !=等符号进行的二元运算产生布尔对象

pandas小结

Series = 索引+ 一维数据

DataFrame= 行列索引+ 二维数据

重新索引、数据删除、算术运算、比较运算

像对待单一数据一样对待Series和DataFrame对象

代码示例

# -*- coding: utf-8 -*-
# @File    : pandas_demo.py
# @Date    : 2018-05-20
# pandas数据类型的算术运算
import pandas as pd
import numpy as np
# 数据准备
a = pd.DataFrame(np.arange(12).reshape(3, 4))
print(a)
"""
   0  1   2   3
0  0  1   2   3
1  4  5   6   7
2  8  9  10  11
"""
b = pd.DataFrame(np.arange(20).reshape(4, 5))
print(b)
"""
    0   1   2   3   4
0   0   1   2   3   4
1   5   6   7   8   9
2  10  11  12  13  14
3  15  16  17  18  19
"""
# 算术运算
# 自动补齐,缺项补NaN
c = a + b
print(c)
"""
      0     1     2     3   4
0   0.0   2.0   4.0   6.0 NaN
1   9.0  11.0  13.0  15.0 NaN
2  18.0  20.0  22.0  24.0 NaN
3   NaN   NaN   NaN   NaN NaN
"""
d = a * b
print(d)
"""
      0     1      2      3   4
0   0.0   1.0    4.0    9.0 NaN
1  20.0  30.0   42.0   56.0 NaN
2  80.0  99.0  120.0  143.0 NaN
3   NaN   NaN    NaN    NaN NaN
"""
# fill_value参数替代NaN,替代后参与运算
e = a.add(b, fill_value=10)
print(e)
"""
      0     1     2     3     4
0   0.0   2.0   4.0   6.0  14.0
1   9.0  11.0  13.0  15.0  19.0
2  18.0  20.0  22.0  24.0  24.0
3  25.0  26.0  27.0  28.0  29.0
"""
f = a.mul(b, fill_value=10)
print(f)
"""
       0      1      2      3      4
0    0.0    1.0    4.0    9.0   40.0
1   20.0   30.0   42.0   56.0   90.0
2   80.0   99.0  120.0  143.0  140.0
3  150.0  160.0  170.0  180.0  190.0
"""
# 不同维度间为广播运算,一维Series默认在轴1参与运算
s = pd.Series(np.arange(10, 15, 1))
print(s)
"""
0    10
1    11
2    12
3    13
4    14
dtype: int32
"""
s1 = s -10
print(s1)
"""
0    0
1    1
2    2
3    3
4    4
dtype: int32
"""
b2 = b - s
print(b2)
"""
    0   1   2   3   4
0 -10 -10 -10 -10 -10
1  -5  -5  -5  -5  -5
2   0   0   0   0   0
3   5   5   5   5   5
"""
# 使用运算方法可以令一维Series参与轴0运算
s = pd.Series(np.arange(4))
print(s)
"""
0    0
1    1
2    2
3    3
dtype: int32
"""
b3 = b.sub(s, axis=0)
print(b3)
"""
    0   1   2   3   4
0   0   1   2   3   4
1   4   5   6   7   8
2   8   9  10  11  12
3  12  13  14  15  16
"""
# 比较运算
a = pd.DataFrame(np.arange(12).reshape(3, 4))
print(a)
"""
   0  1   2   3
0  0  1   2   3
1  4  5   6   7
2  8  9  10  11
"""
b = pd.DataFrame(np.arange(12, 0, -1).reshape(3, 4))
print(b)
"""
    0   1   2  3
0  12  11  10  9
1   8   7   6  5
2   4   3   2  1
"""
# 同维度运算,尺寸一致
c = a > b
print(c)
"""
       0      1      2      3
0  False  False  False  False
1  False  False  False   True
2   True   True   True   True
"""
d = a == b
print(d)
"""
       0      1      2      3
0  False  False  False  False
1  False  False   True  False
2  False  False  False  False
"""
# 不同维度,广播运算,默认在1轴
s = pd.Series(np.arange(4))
print(s)
"""
0    0
1    1
2    2
3    3
dtype: int32
"""
print(a > s)
"""
       0      1      2      3
0  False  False  False  False
1   True   True   True   True
2   True   True   True   True
"""
print(s > 0)
"""
0    False
1     True
2     True
3     True
dtype: bool
"""
相关文章
|
2月前
|
数据采集 存储 数据挖掘
Python数据分析:Pandas库的高效数据处理技巧
【10月更文挑战第27天】在数据分析领域,Python的Pandas库因其强大的数据处理能力而备受青睐。本文介绍了Pandas在数据导入、清洗、转换、聚合、时间序列分析和数据合并等方面的高效技巧,帮助数据分析师快速处理复杂数据集,提高工作效率。
81 0
|
2月前
|
机器学习/深度学习 算法 数据挖掘
数据分析的 10 个最佳 Python 库
数据分析的 10 个最佳 Python 库
98 4
数据分析的 10 个最佳 Python 库
|
2月前
|
数据采集 数据可视化 数据处理
Python数据科学:Pandas库入门与实践
Python数据科学:Pandas库入门与实践
|
2月前
|
机器学习/深度学习 数据采集 数据可视化
Python数据科学实战:从Pandas到机器学习
Python数据科学实战:从Pandas到机器学习
|
2月前
|
机器学习/深度学习 数据采集 数据挖掘
解锁 Python 数据分析新境界:Pandas 与 NumPy 高级技巧深度剖析
Pandas 和 NumPy 是 Python 中不可或缺的数据处理和分析工具。本文通过实际案例深入剖析了 Pandas 的数据清洗、NumPy 的数组运算、结合两者进行数据分析和特征工程,以及 Pandas 的时间序列处理功能。这些高级技巧能够帮助我们更高效、准确地处理和分析数据,为决策提供支持。
50 2
|
2月前
|
数据采集 数据可视化 数据挖掘
Python数据分析:Pandas库实战指南
Python数据分析:Pandas库实战指南
|
2月前
|
并行计算 数据挖掘 大数据
Python数据分析实战:利用Pandas处理大数据集
Python数据分析实战:利用Pandas处理大数据集
|
2月前
|
数据采集 数据可视化 数据挖掘
利用Python进行数据分析:Pandas库实战指南
利用Python进行数据分析:Pandas库实战指南
|
2月前
|
SQL 数据挖掘 Python
数据分析编程:SQL,Python or SPL?
数据分析编程用什么,SQL、python or SPL?话不多说,直接上代码,对比明显,明眼人一看就明了:本案例涵盖五个数据分析任务:1) 计算用户会话次数;2) 球员连续得分分析;3) 连续三天活跃用户数统计;4) 新用户次日留存率计算;5) 股价涨跌幅分析。每个任务基于相应数据表进行处理和计算。
|
5月前
|
数据采集 数据可视化 数据挖掘
数据分析大神养成记:Python+Pandas+Matplotlib助你飞跃!
在数字化时代,数据分析至关重要,而Python凭借其强大的数据处理能力和丰富的库支持,已成为该领域的首选工具。Python作为基石,提供简洁语法和全面功能,适用于从数据预处理到高级分析的各种任务。Pandas库则像是神兵利器,其DataFrame结构让表格型数据的处理变得简单高效,支持数据的增删改查及复杂变换。配合Matplotlib这一数据可视化的魔法棒,能以直观图表展现数据分析结果。掌握这三大神器,你也能成为数据分析领域的高手!
95 2