Python 文件的读写操作

简介: Python 文件的读写操作

一、Python 文件读写概述

Python 在文件读写操作中,会使用「内置函数」和「Pandas 库」两种方式。

先来看内置函数,包括 open()、read()、readline()、readlines()、write()、writelines()、close() 等方法,也是接下来给大家详细介绍的内容。

再看 Pandas 库,包括 read_csv()、to_csv()、read_excel()、to_excel()、read_json()、to_json() 等方法,我们后面讲到 Pandas 库的时候,再详细讲讲。

在使用「内置函数」的时候,思路基本上是:

1、打开文件

2、开始「读」或者「写」的操作

3、关闭文件

二、使用 open() 打开文件

Python 使用 open() 方法,可以根据指定文件名或标识符来打开文件。

语法格式:

file = open('filename.txt', mode = 'r')

获取到的 file 是一个文件对象。

Python 文件的打开模式,有如下几种,且可以组合使用:

模式 描述
‘r’ 以「只读」模式打开文件,如果指定文件不存在,则会报错,默认情况下文件指针指向文件开头
‘w’ 以「只写」模式打开文件,如果文件不存在,则根据 filename 创建相应的文件,如果文件已存在,则会覆盖原文件
‘a’ 以「追加」模式打开文件,如果文件已存在,文件指针会指向文件尾部,将内容追加在原文件后面,如果文件不存在,则会新建文件且写入内容
‘t’ 以「文本文件」模式打开文件
‘b’ 以「二进制」模式打开文件,主要用于打开图片、音频等非文本文件
‘+’ 打开文件并允许更新(可读可写),也就是说,使用参数 w+、a+ 也是可以读入文件的,在使用的时候,需要注意区别

再告诉你一个秘密,我们在操作文件的时候,因为内容很多,所以我们前面学到的「循环」终于可以大派用场了,比如「for 循环」就会经常被使用到。

案例代码:

第一步,新建 hello.txt 文件,如下:

当你慢慢调整了自己看待问题的角度,
也提升了思考的深度,你竟然会发现,
你所处在的「超一线城市」其实是一个「场」。
在这个场域里头,你可以遇见无限的可能性,
每一个维度都暗含大蓝海,都有大把的机会,
你甚至运气爆棚,在某次从天而降的大机遇中,
能迅速成长为自己可能完全没法想象的人。

第二步,使用 for 循环读取文件,如下:

# 打开 hello.txt 文件,指定「只读模式」
hello = open('hello.txt', 'r')
# 使用 for 循环,将读到的内容,打印出来
num = 1
for con in hello:
    print('第 %d 行:' % num, con)
    num += 1
# 最后需要将文件关闭
hello.close()

第三步,改良,使用 read() 方法读取

# 打开 hello.txt 文件,指定「只读模式」
hello = open('hello.txt', 'r')
# 使用 read()
con = hello.read()
# 打印
print(con)
# 最后需要将文件关闭
hello.close()

拓展:

如果,我将上面的第二步和第三步,放在同一个文件中写,就会出现「文本文件指针复位」的问题。

因为我们通过 for 循环,已经让「文本文件指针」从文件的开头读到文本末尾,已经把所有内容读取,此时指针在文末位置。

如果说,再让程序执行 read() 方法,则会发现后面已经没有内容可读了,所以程序执行后,不会输出任何内容。

解决办法,调用 seek() 方法,指定偏移量为 0,来将文本文件指针「复位」即可。

你还可以通过 tell() 方法,获取文件指针的当前位置。如果此时文件指针在文末位置,获取到的其实就是整个文本的字节数,也相当是这个文件的大小了。

# 打开 hello.txt 文件,指定「只读模式」
hello = open('hello.txt', 'r')
# 使用 for 循环,将读到的内容,打印出来
num = 1
for con in hello:
    print('第 %d 行:' % num, con)
    num += 1
# 获取文件指针的位置
print(hello.tell())
    
# 将文本文件的指针,复位
hello.seek(0)
# 使用 read()
con = hello.read()
print("---- 使用 read() -----")
print(con)
# 最后需要将文件关闭
hello.close()

三、使用 read()、readline()、readlines() 读取数据

当文件很大的时候,单纯使用 read() 方法就很难一次性读入内存中。

可以使用 readline() 方法,从文中读取整行信息。

案例代码:

# 打开 hello.txt 文件,指定「只读模式」
hello = open('hello.txt', 'r')
# 使用 readline(),读取一行信息
con = hello.readline()
print(con)
# 最后需要将文件关闭
hello.close()

但如果想读取所有行的信息,就需要使用 readlines() 方法了

readlines() 和 read() 的区别,在于读取的「颗粒大小」,前者颗粒较大以行为单位,后者颗粒较小以字节为单位。

案例代码:

# 打开 hello.txt 文件,指定「只读模式」
hello = open('hello.txt', 'r')
# 使用 readlines(),读取全部信息
con = hello.readlines()
print(con)
# 最后需要将文件关闭
hello.close()

另外,提醒一下,读写文件的时候,经常会出现一些 IOError 错误异常,建议写在 try…finally… 异常捕获块中,养成良好的编码习惯。

比如,我们经常执行到最后,会忘记关闭文件,这就很可能会带来很多潜在的问题,可以在 finally 中,也就是程序最后会执行的部分,去关闭我们已打开的文件。

案例代码:

try:
    # 打开 hello.txt 文件,指定「只读模式」
    hello = open('helo.txt', 'r')
    # 使用 readlines(),读取全部信息
    con = hello.readlines()
    print(con)
finally:
    print('出问题了')
    # 最后需要将文件关闭
    hello.close()

四、使用 write()、writelines() 写入文件

还有一种更好玩儿,可以用 with…as… 语句,它天生用来防止我们忘记关闭文件。

当你引入 with 语句,它会在你访问完文件之后,根据上下文自动调用 close() 方法来关闭。

语法格式:

with expression as target :
    statements

案例代码:

with open('hello.txt') as hello :
    hello.write("I Love You")

在上面的代码中,我们在打开文件的时候,指定了 ‘w’ 模式,启动了写的操作。而且还使用了一个 write() 方法,它是用来向文件中写入指定字符串的。

在代码中操作的字符串内容,主要存储在缓冲区,我们在文件关闭前或缓冲区刷新前,可以将它写入文件。

最后,用一下 writelines() 方法,将列表中的三行数据,写到文件中。

案例代码:

# 创建一个列表
txtlist = ['Python 私教\n', 'Java 私教\n', 'C++ 私教\n']
# 写入文件
with open('hello.txt') as hello :
    hello.writelines(txtlist)

最后

我是帅帅,一个默默做了 7 年的 Java 编程、架构师成长教练。

很喜欢罗曼·罗兰的一句话:“人最可贵之处在于看透生活的本质后,依然热爱生活 ”。

愿我们一起,努力追寻本质,依然保持热爱。

目录
相关文章
|
11天前
|
机器学习/深度学习 存储 算法
解锁文件共享软件背后基于 Python 的二叉搜索树算法密码
文件共享软件在数字化时代扮演着连接全球用户、促进知识与数据交流的重要角色。二叉搜索树作为一种高效的数据结构,通过有序存储和快速检索文件,极大提升了文件共享平台的性能。它依据文件名或时间戳等关键属性排序,支持高效插入、删除和查找操作,显著优化用户体验。本文还展示了用Python实现的简单二叉搜索树代码,帮助理解其工作原理,并展望了该算法在分布式计算和机器学习领域的未来应用前景。
|
21天前
|
监控 网络安全 开发者
Python中的Paramiko与FTP文件夹及文件检测技巧
通过使用 Paramiko 和 FTP 库,开发者可以方便地检测远程服务器上的文件和文件夹是否存在。Paramiko 提供了通过 SSH 协议进行远程文件管理的能力,而 `ftplib` 则提供了通过 FTP 协议进行文件传输和管理的功能。通过理解和应用这些工具,您可以更加高效地管理和监控远程服务器上的文件系统。
51 20
|
27天前
|
存储 数据采集 数据处理
如何在Python中高效地读写大型文件?
大家好,我是V哥。上一篇介绍了Python文件读写操作,今天聊聊如何高效处理大型文件。主要方法包括:逐行读取、分块读取、内存映射(mmap)、pandas分块处理CSV、numpy处理二进制文件、itertools迭代处理及linecache逐行读取。这些方法能有效节省内存,提升效率。关注威哥爱编程,学习更多Python技巧。
|
28天前
|
存储 JSON 对象存储
如何使用 Python 进行文件读写操作?
大家好,我是V哥。本文介绍Python中文件读写操作的方法,包括文件读取、写入、追加、二进制模式、JSON、CSV和Pandas模块的使用,以及对象序列化与反序列化。通过这些方法,你可以根据不同的文件类型和需求,灵活选择合适的方式进行操作。希望对正在学习Python的小伙伴们有所帮助。欢迎关注威哥爱编程,全栈路上我们并肩前行。
|
1月前
|
存储 算法 Serverless
剖析文件共享工具背后的Python哈希表算法奥秘
在数字化时代,文件共享工具不可或缺。哈希表算法通过将文件名或哈希值映射到存储位置,实现快速检索与高效管理。Python中的哈希表可用于创建简易文件索引,支持快速插入和查找文件路径。哈希表不仅提升了文件定位速度,还优化了存储管理和多节点数据一致性,确保文件共享工具高效运行,满足多用户并发需求,推动文件共享领域向更高效、便捷的方向发展。
|
2月前
|
计算机视觉 Python
如何使用Python将TS文件转换为MP4
本文介绍了如何使用Python和FFmpeg将TS文件转换为MP4文件。首先需要安装Python和FFmpeg,然后通过`subprocess`模块调用FFmpeg命令,实现文件格式的转换。代码示例展示了具体的操作步骤,包括检查文件存在性、构建FFmpeg命令和执行转换过程。
76 7
|
4月前
|
自然语言处理 数据处理 Python
python操作和解析ppt文件 | python小知识
本文将带你从零开始,了解PPT解析的工具、工作原理以及常用的基本操作,并提供具体的代码示例和必要的说明【10月更文挑战第4天】
678 60
|
4月前
|
安全 Linux 数据安全/隐私保护
python知识点100篇系列(15)-加密python源代码为pyd文件
【10月更文挑战第5天】为了保护Python源码不被查看,可将其编译成二进制文件(Windows下为.pyd,Linux下为.so)。以Python3.8为例,通过Cython工具,先写好Python代码并加入`# cython: language_level=3`指令,安装easycython库后,使用`easycython *.py`命令编译源文件,最终生成.pyd文件供直接导入使用。
147 3
python知识点100篇系列(15)-加密python源代码为pyd文件
|
4月前
|
Linux 区块链 Python
Python实用记录(十三):python脚本打包exe文件并运行
这篇文章介绍了如何使用PyInstaller将Python脚本打包成可执行文件(exe),并提供了详细的步骤和注意事项。
185 1
Python实用记录(十三):python脚本打包exe文件并运行
|
3月前
|
开发者 Python
Python中__init__.py文件的作用
`__init__.py`文件在Python包管理中扮演着重要角色,通过标识目录为包、初始化包、控制导入行为、支持递归包结构以及定义包的命名空间,`__init__.py`文件为组织和管理Python代码提供了强大支持。理解并正确使用 `__init__.py`文件,可以帮助开发者更好地组织代码,提高代码的可维护性和可读性。
178 2

热门文章

最新文章

推荐镜像

更多