删除大文件中的一行内容

Posted niansi

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了删除大文件中的一行内容相关的知识,希望对你有一定的参考价值。

用 python 处理一个文本文件时,如果想要删除其中的某一行,常规的思路是先把文件读入内存,在内存中修改后再写入源文件。

这对于小文件来说当然没问题,但是如果要处理一个很大的文本,比如GB级别的文本时,这种方法不仅需要占用很大内存,而且一次性读入内存时耗费时间,还有可能导致内存溢出。

所以,需要用另外一个思路去处理。

我们可以使用 open() 方法把需要修改的文件打开为两个文件,然后逐行读入内存,找到需要删除的行时,用后面的行逐一覆盖。实现方式见以下代码。


with open(‘file.txt‘, ‘r‘) as old_file:
    with open(‘file.txt‘, ‘r+‘) as new_file:

        current_line = 0

        # 定位到需要删除的行
        while current_line < (del_line - 1):
            old_file.readline()
            current_line += 1

        # 当前光标在被删除行的行首,记录该位置
        seek_point = old_file.tell()

        # 设置光标位置
        new_file.seek(seek_point, 0)

        # 读需要删除的行,光标移到下一行行首
        old_file.readline()

        # 被删除行的下一行读给 next_line
        next_line = old_file.readline()

        # 连续覆盖剩余行,后面所有行上移一行
        while next_line:
            new_file.write(next_line)
            next_line = old_file.readline()

        # 写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉
        new_file.truncate()

以上是关于删除大文件中的一行内容的主要内容,如果未能解决你的问题,请参考以下文章

Linux命令应用大词典-第6章 文件处理

python 在大文件里面删除某一行,比较有效率的方法

记一次删除Git记录中的大文件的过程

如何从 C# 中的文本文件中删除一行?

使用“总计”信息删除 csv 文件中的最后一行

Python3读取大文件的方法