python 删除大文件中的某一行(最有效率的方法)


Posted in Python onAugust 19, 2017

用 python 处理一个文本时,想要删除其中中某一行,常规的思路是先把文件读入内存,在内存中修改后再写入源文件。

但如果要处理一个很大的文本,比如GB级别的文本时,这种方法不仅需要占用很大内存,而且一次性读入内存时耗费时间,还有可能导致内存溢出。

所以,需要用另外一个思路去处理。

我们可以使用 open() 方法把需要修改的文件打开为两个文件,然后逐行读入内存,找到需要删除的行时,用后面的行逐一覆盖。实现方式见以下代码。

with open('file.txt', 'r') as old_file:
  with open('file.txt', 'r+') as new_file:

    current_line = 0

    # 定位到需要删除的行
    while current_line < (del_line - 1):
      old_file.readline()
      current_line += 1

    # 当前光标在被删除行的行首,记录该位置
    seek_point = old_file.tell()

    # 设置光标位置
    new_file.seek(seek_point, 0)

    # 读需要删除的行,光标移到下一行行首
    old_file.readline()
    
    # 被删除行的下一行读给 next_line
    next_line = old_file.readline()

    # 连续覆盖剩余行,后面所有行上移一行
    while next_line:
      new_file.write(next_line)
      next_line = old_file.readline()

    # 写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉
    new_file.truncate()

以上这篇python 删除大文件里的某一行(最有效率的方法)就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持三水点靠木。

Python 相关文章推荐
简单介绍Python中用于求最小值的min()方法
May 15 Python
python中argparse模块用法实例详解
Jun 03 Python
Python语言描述机器学习之Logistic回归算法
Dec 21 Python
celery4+django2定时任务的实现代码
Dec 23 Python
python实现关闭第三方窗口的方法
Jun 28 Python
Python PyCharm如何进行断点调试
Jul 05 Python
基于numpy中的expand_dims函数用法
Dec 18 Python
python网络编程socket实现服务端、客户端操作详解
Mar 24 Python
在脚本中单独使用django的ORM模型详解
Apr 01 Python
python字符串的index和find的区别详解
Jun 20 Python
Python性能测试工具Locust安装及使用
Dec 01 Python
Python装饰器详细介绍
Mar 25 Python
在java中如何定义一个抽象属性示例详解
Aug 18 #Python
python中将函数赋值给变量时需要注意的一些问题
Aug 18 #Python
python中子类调用父类函数的方法示例
Aug 18 #Python
Python设计实现的计算器功能完整实例
Aug 18 #Python
python中类和实例如何绑定属性与方法示例详解
Aug 18 #Python
Python实现基于多线程、多用户的FTP服务器与客户端功能完整实例
Aug 18 #Python
对python中return和print的一些理解
Aug 18 #Python
You might like
TP5.0框架实现无限极回复功能的方法分析
2019/05/04 PHP
js 新浪的一个图片播放图片轮换效果代码
2008/07/15 Javascript
单元选择合并变色示例代码
2014/05/26 Javascript
常用jQuery选择器总结
2014/07/11 Javascript
jQuery解析json数据实例分析
2015/11/24 Javascript
jQuery获取浏览器类型和版本号的方法
2016/07/05 Javascript
微信小程序 网络API发起请求详解
2016/11/09 Javascript
详解Vue-cli代理解决跨域问题
2017/09/27 Javascript
详解Angular Forms中自定义ngModel绑定值的方式
2018/12/10 Javascript
Vue唯一可以更改vuex实例中state数据状态的属性对象Mutation的讲解
2019/01/18 Javascript
vue组件间的参数传递实例详解
2019/04/26 Javascript
Js代码中的span拼接问题解决
2019/11/22 Javascript
浅谈Vuex的this.$store.commit和在Vue项目中引用公共方法
2020/07/24 Javascript
js实现tab栏切换效果
2020/08/02 Javascript
探索浏览器页面关闭window.close()的使用详解
2020/08/21 Javascript
vue点击Dashboard不同内容 跳转到同一表格的实例
2020/11/13 Javascript
[04:21]狐狸妈带你到现场 DOTA2 TI中国区预选赛线下赛路线指引
2014/05/22 DOTA
跟老齐学Python之大话题小函数(2)
2014/10/10 Python
Python使用bs4获取58同城城市分类的方法
2015/07/08 Python
Python selenium 三种等待方式解读
2016/09/15 Python
Python做简单的字符串匹配详解
2017/03/21 Python
python通过socket实现多个连接并实现ssh功能详解
2017/11/08 Python
python实现将excel文件转化成CSV格式
2018/03/22 Python
利用python实现微信头像加红色数字功能
2018/03/26 Python
浅谈PyQt5 的帮助文档查找方法,可以查看每个类的方法
2019/06/25 Python
详解Python二维数组与三维数组切片的方法
2019/07/18 Python
Python命令行参数解析工具 docopt 安装和应用过程详解
2019/09/26 Python
Python操作注册表详细步骤介绍
2020/02/05 Python
详解Python GUI编程之PyQt5入门到实战
2020/12/10 Python
Linux的主要特性
2014/10/06 面试题
勤奋学习演讲稿
2014/05/10 职场文书
监督检查工作方案
2014/05/28 职场文书
运动会口号16字
2014/06/07 职场文书
《所见》教学反思
2016/02/23 职场文书
Python包管理工具pip的15 个使用小技巧
2021/05/17 Python
Spring事务管理下synchronized锁失效问题的解决方法
2022/03/31 Java/Android