开发者社区开发与运维文章正文

pandas数据处理高级系列001-如何用一行代码优雅的删除一行数据中不包含特定字符串的行

2023-02-08 280

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： pandas数据处理高级系列001-如何用一行代码优雅的删除一行数据中不包含特定字符串的行

方法一实现起来最简单，但是并不优雅，最优雅的是方法三，用了一行代码实现了。

import pandas as pd
data = pd.read_excel("c:/result/xxx.xlsx")
# print(data.head())
# 只保留行的数据当中含有特定字符的行
target_str = "yyy"
# 方法1-笨方法，遍历每一行，每一列，虽然实现了这个要求，但是很不优雅
result_list = []
for index, row in data.iterrows():
    r = False
    for i in row:
        if target_str in str(i):
            r = True
    if r:
        result_list.append(row)
df1 = pd.DataFrame(result_list)
print(df1)
# 方法2- 使用apply函数
df2 = pd.read_excel("c:/result/xxx.xlsx")
df2["c"] = df2.apply(lambda x: x.str.contains(target_str).any(), axis=1)
df2 = df2[df2['c']==True].drop(columns="c")
print(df2)
# 方法3
df3 = pd.read_excel("c:/result/xxx.xlsx")
df3 = df3[df3.apply(lambda x: x.str.contains(target_str).any(), axis=1)]
print(df3)
assert list(df1.index) == list(df2.index) == list(df3.index)
print("测试成功")

文章标签：

Python

数据处理

关键词：

Pandas数据处理

Pandas数据处理数据

Pandas高级

Pandas行

Pandas字符串

tianjixuetu

凉凉心.

2月前

Java 数据处理索引

（Pandas）Python做数据处理必选框架之一！（二）：附带案例分析；刨析DataFrame结构和其属性；学会访问具体元素；判断元素是否存在；元素求和、求标准值、方差、去重、删除、排序...

DataFrame结构每一列都属于Series类型，不同列之间数据类型可以不一样，但同一列的值类型必须一致。 DataFrame拥有一个总的 idx记录列，该列记录了每一行的索引在DataFrame中，若列之间的元素个数不匹配，且使用Series填充时，在DataFrame里空值会显示为NaN；当列之间元素个数不匹配，并且不使用Series填充，会报错。在指定了index 属性显示情况下，会按照index的位置进行排序，默认是 [0,1,2,3,...] 从0索引开始正序排序行。

凉凉心.

258 0 0

凉凉心.

2月前

Java 数据挖掘数据处理

（Pandas）Python做数据处理必选框架之一！（一）：介绍Pandas中的两个数据结构；刨析Series：如何访问数据；数据去重、取众数、总和、标准差、方差、平均值等；判断缺失值、获取索引...

Pandas 是一个开源的数据分析和数据处理库，它是基于 Python 编程语言的。 Pandas 提供了易于使用的数据结构和数据分析工具，特别适用于处理结构化数据，如表格型数据（类似于Excel表格）。 Pandas 是数据科学和分析领域中常用的工具之一，它使得用户能够轻松地从各种数据源中导入数据，并对数据进行高效的操作和分析。 Pandas 主要引入了两种新的数据结构：Series 和 DataFrame。

凉凉心.

411 0 0

Deephub

7月前

数据采集安全数据挖掘

Pandas数据合并：10种高效连接技巧与常见问题

在数据分析中，数据合并是常见且关键的步骤。本文针对合并来自多个来源的数据集时可能遇到的问题，如列丢失、重复记录等，提供系统解决方案。基于对超1000个复杂数据集的分析经验，总结了10种关键技术，涵盖Pandas库中`merge`和`join`函数的使用方法。内容包括基本合并、左连接、右连接、外连接、基于索引连接、多键合并、数据拼接、交叉连接、后缀管理和合并验证等场景。通过实际案例与技术原理解析，帮助用户高效准确地完成数据整合任务，提升数据分析效率。

Deephub

647 13 13

站大爷

4月前

存储数据采集数据处理

Pandas与NumPy：Python数据处理的双剑合璧

Pandas与NumPy是Python数据科学的核心工具。NumPy以高效的多维数组支持数值计算，适用于大规模矩阵运算；Pandas则提供灵活的DataFrame结构，擅长处理表格型数据与缺失值。二者在性能与功能上各具优势，协同构建现代数据分析的技术基石。

站大爷

374 0 0

站大爷

6月前

运维数据挖掘数据处理

Pandas时间数据处理：从基础到进阶的实战指南

Pandas时间数据处理涵盖了从基础到高级的全面功能。其核心由Timestamp、DatetimeIndex、Period和Timedelta四个类构建，支持精准的时间点与区间操作。内容包括时间数据生成（字符串解析与序列生成）、时间索引与切片、高级运算（偏移重采样与窗口计算）、时区处理、周期性数据分析及实战案例（如智能电表数据）。此外，还涉及性能优化技巧和未来展望，帮助用户高效处理时间序列数据并应用于预测分析等场景。

站大爷

283 1 2

站大爷

6月前

传感器安全数据处理

Pandas时间数据处理：从基础到进阶的实战指南

本文深入讲解Pandas时间数据处理技巧，从时间对象转换到高性能计算全面覆盖。通过真实案例拆解，掌握Timestamp与Period的核心概念、时间序列生成、重采样方法及窗口函数应用。同时剖析时区处理、性能优化策略及常见陷阱解决方案，并展望Pandas 2.0的时间处理新特性。内容强调“时间索引优先”原则，助你高效分析股票K线、用户行为等时间序列数据。

站大爷

178 0 0

长梦

10月前

缓存数据可视化 BI

Pandas高级数据处理：数据仪表板制作

在数据分析中，面对庞大、多维度的数据集（如销售记录、用户行为日志），直接查看原始数据难以快速抓住重点。传统展示方式（如Excel表格）缺乏交互性和动态性，影响决策效率。为此，我们利用Python的Pandas库构建数据仪表板，具备数据聚合筛选、可视化图表生成和性能优化功能，帮助业务人员直观分析不同品类商品销量分布、省份销售额排名及日均订单量变化趋势，提升数据洞察力与决策效率。

长梦

224 12 12

长梦

10月前

数据可视化数据挖掘数据处理

Pandas高级数据处理：数据可视化进阶

Pandas是数据分析的强大工具，能高效处理数据并与Matplotlib、Seaborn等库集成，实现数据可视化。本文介绍Pandas在绘制基础图表（如折线图）和进阶图表（如分组柱状图、热力图）时的常见问题及解决方案，涵盖数据准备、报错处理、图表优化等内容，并通过代码案例详细解释，帮助读者掌握数据可视化的技巧。

长梦

223 13 13

长梦

10月前

数据采集 SQL 数据可视化

Pandas高级数据处理：交互式数据探索

Pandas是Python中流行的数据分析库，提供丰富的数据结构和函数，简化数据操作。本文从基础到高级介绍Pandas的使用，涵盖安装、读取CSV/Excel文件、数据查看与清洗、类型转换、条件筛选、分组聚合及可视化等内容。掌握这些技能，能高效进行交互式数据探索和预处理。

长梦

133 6 11

长梦

10月前

数据采集存储数据可视化

Pandas高级数据处理：数据报告生成

Pandas 是数据分析领域不可或缺的工具，支持多种文件格式的数据读取与写入、数据清洗、筛选与过滤。本文从基础到高级，介绍如何使用 Pandas 进行数据处理，并解决常见问题和报错，如数据类型不一致、时间格式解析错误、内存不足等。最后，通过数据汇总、可视化和报告导出，生成专业的数据报告，帮助你在实际工作中更加高效地处理数据。

长梦

287 8 8

pandas数据处理高级系列001-如何用一行代码优雅的删除一行数据中不包含特定字符串的行

热门文章

最新文章

相关课程

相关电子书

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

pandas数据处理高级系列001-如何用一行代码优雅的删除一行数据中不包含特定字符串的行

热门文章

最新文章

相关课程

相关电子书