python 删除大文件中的某一行(最有效率的方法),
python 删除大文件中的某一行(最有效率的方法),
用 python 处理一个文本时,想要删除其中中某一行,常规的思路是先把文件读入内存,在内存中修改后再写入源文件。
但如果要处理一个很大的文本,比如GB级别的文本时,这种方法不仅需要占用很大内存,而且一次性读入内存时耗费时间,还有可能导致内存溢出。
所以,需要用另外一个思路去处理。
我们可以使用 open() 方法把需要修改的文件打开为两个文件,然后逐行读入内存,找到需要删除的行时,用后面的行逐一覆盖。实现方式见以下代码。
with open('file.txt', 'r') as old_file: with open('file.txt', 'r+') as new_file: current_line = 0 # 定位到需要删除的行 while current_line < (del_line - 1): old_file.readline() current_line += 1 # 当前光标在被删除行的行首,记录该位置 seek_point = old_file.tell() # 设置光标位置 new_file.seek(seek_point, 0) # 读需要删除的行,光标移到下一行行首 old_file.readline() # 被删除行的下一行读给 next_line next_line = old_file.readline() # 连续覆盖剩余行,后面所有行上移一行 while next_line: new_file.write(next_line) next_line = old_file.readline() # 写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉 new_file.truncate()
以上这篇python 删除大文件里的某一行(最有效率的方法)就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持帮客之家。
相关内容
- Python正则捕获操作示例,python捕获示例
- Python基于numpy灵活定义神经网络结构的方法,pythonnump
- Python获取当前页面内所有链接的四种方法对比分析,
- Python实现爬取需要登录的网站完整示例,python示例
- Python 基础教程之str和repr的详解,pythonrepr
- Python中input与raw_input 之间的比较,pythonraw_input
- 详解Python 序列化Serialize 和 反序列化Deserialize,
- python 实现tar文件压缩解压的实例详解,
- python 垃圾收集机制的实例详解,python垃圾收集
- 基于Python对象引用、可变性和垃圾回收详解,python垃圾
评论关闭