详解python解压压缩包的五种方法


Posted in Python onJuly 05, 2019

这里讨论使用Python解压例如以下五种压缩文件:

.gz .tar  .tgz .zip .rar

简单介绍

gz: 即gzip。通常仅仅能压缩一个文件。与tar结合起来就能够实现先打包,再压缩。

tar: linux系统下的打包工具。仅仅打包。不压缩

tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

zip: 不同于gzip。尽管使用相似的算法,能够打包压缩多个文件。只是分别压缩文件。压缩率低于tar。

rar:打包压缩文件。最初用于DOS,基于window操作系统。

压缩率比zip高,但速度慢。随机?问的速度也慢。

关于zip于rar之间的各种比?。可见:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

因为gz一般仅仅压缩一个文件,全部常与其它打包工具一起工作。比方能够先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

解压gz,事实上就是读出当中的单一文件,Python方法例如以下:

import gzip
import os
def un_gz(file_name):
 """ungz zip file"""
 f_name = file_name.replace(".gz", "")
 #获取文件的名称,去掉
 g_file = gzip.GzipFile(file_name)
 #创建gzip对象
 open(f_name, "w+").write(g_file.read())
 #gzip对象用read()打开后,写入open()建立的文件里。
 g_file.close()
 #关闭gzip对象

tar

XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

*注:tgz与tar.gz是同样的格式,老版本号DOS扩展名最多三个字符,故用tgz表示。

因为这里有多个文件,我们先读取全部文件名称。然后解压。例如以下:

import tarfile
def un_tar(file_name):
  untar zip file"""
 tar = tarfile.open(file_name)
 names = tar.getnames()
 if os.path.isdir(file_name + "_files"):
  pass
 else:
  os.mkdir(file_name + "_files")
 #因为解压后是很多文件,预先建立同名目录
 for name in names:
  tar.extract(name, file_name + "_files/")
 tar.close()

*注:tgz文件与tar文件同样的解压方法。

zip

与tar类似,先读取多个文件名称,然后解压。例如以下:

import zipfile
def un_zip(file_name):
 """unzip zip file"""
 zip_file = zipfile.ZipFile(file_name)
 if os.path.isdir(file_name + "_files"):
  pass
 else:
  os.mkdir(file_name + "_files")
 for names in zip_file.namelist():
  zip_file.extract(names,file_name + "_files/")
 zip_file.close()

rar

由于rar通常为window下使用,须要额外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解压到Python安装文件夹的/Scripts/文件夹下,在当前窗体打开命令行,

输入Python setup.py install

安装完毕。

import rarfile
import os
def un_rar(file_name):
 """unrar zip file"""
 rar = rarfile.RarFile(file_name)
 if os.path.isdir(file_name + "_files"):
  pass
 else:
  os.mkdir(file_name + "_files")
 os.chdir(file_name + "_files"):
 rar.extractall()
 rar.close()

tar打包

在写打包代码的过程中,使用tar.add()添加文件时,会把文件本身的路径也加进去,加上arcname就能依据自己的命名规则将文件添加tar包

打包代码:

#!/usr/bin/env /usr/local/bin/python 
 # encoding: utf-8 
 import tarfile 
 import os 
 import time 
 
 start = time.time() 
 tar=tarfile.open('/path/to/your.tar,'w') 
 for root,dir,files in os.walk('/path/to/dir/'): 
   for file in files: 
     fullpath=os.path.join(root,file) 
     tar.add(fullpath,arcname=file) 
 tar.close() 
 print time.time()-start

在打包的过程中能够设置压缩规则,如想要以gz压缩的格式打包

tar=tarfile.open('/path/to/your.tar.gz','w:gz')

其它格式例如以下表:

tarfile.open的mode有非常多种:

mode action

tar解包

tar解包也能够依据不同压缩格式来解压。

#!/usr/bin/env /usr/local/bin/python 
 # encoding: utf-8 
 import tarfile 
 import time 
 
 start = time.time() 
 t = tarfile.open("/path/to/your.tar", "r:") 
 t.extractall(path = '/path/to/extractdir/') 
 t.close() 
 print time.time()-start

上面的代码是解压全部的,也能够挨个起做不同的处理,但要假设tar包内文件过多,小心内存哦~ 

tar = tarfile.open(filename, 'r:gz') 
 for tar_info in tar: 
  file = tar.extractfile(tar_info) 
  do_something_with(file)

ps:python实现rar文件解压

1.pip3 install rarfile  安装rarfile库

(注意是解压,压缩这个方法不支持)

#coding=utf-8
import rarfile
path = "E:\\New\\New.rar"
path2 = "E:\\New"
rf = rarfile.RarFile(path)     #待解压文件
rf.extractall(path2)        #解压指定文件路径

总结

以上所述是小编给大家介绍的python解压压缩包的五种方法,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对三水点靠木网站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!

Python 相关文章推荐
Python实现基于HTTP文件传输实例
Nov 08 Python
python通过索引遍历列表的方法
May 04 Python
Python实现快速排序和插入排序算法及自定义排序的示例
Feb 16 Python
Python 正则表达式入门(中级篇)
Dec 07 Python
Python Pandas找到缺失值的位置方法
Apr 12 Python
浅谈python之高阶函数和匿名函数
Mar 21 Python
一篇文章彻底搞懂Python中可迭代(Iterable)、迭代器(Iterator)与生成器(Generator)的概念
May 13 Python
在Python中append以及extend返回None的例子
Jul 20 Python
python获取指定日期范围内的每一天,每个月,每季度的方法
Aug 08 Python
基于python-pptx库中文文档及使用详解
Feb 14 Python
基于Python-turtle库绘制路飞的草帽骷髅旗、美国队长的盾牌、高达的源码
Feb 18 Python
利用Python网络爬虫爬取各大音乐评论的代码
Apr 13 Python
用python3 返回鼠标位置的实现方法(带界面)
Jul 05 #Python
python中的colorlog库使用详解
Jul 05 #Python
Python+selenium点击网页上指定坐标的实例
Jul 05 #Python
用Python实现将一张图片分成9宫格的示例
Jul 05 #Python
python获取txt文件词向量过程详解
Jul 05 #Python
Python 的字典(Dict)是如何存储的
Jul 05 #Python
关于Python 的简单栅格图像边界提取方法
Jul 05 #Python
You might like
laravel 5 实现模板主题功能(续)
2015/03/02 PHP
php将一维数组转换为每3个连续值组成的二维数组
2016/05/06 PHP
Zend Framework入门教程之Zend_Registry组件用法详解
2016/12/09 PHP
JavaScript对象链式操作代码(jquery)
2010/07/04 Javascript
利用javascript解决图片缩放及其优化的代码
2012/05/23 Javascript
jquery实现树形二级菜单实例代码
2013/11/20 Javascript
JavaScript面向对象的实现方法小结
2015/04/14 Javascript
最新最热最实用的15个jQuery插件汇总
2015/07/05 Javascript
JQuery.Ajax()的data参数类型实例详解
2015/11/20 Javascript
手机端图片缩放旋转全屏查看PhotoSwipe.js插件实现
2016/08/25 Javascript
利用Angular.js限制textarea输入的字数
2016/10/20 Javascript
解析Javascript单例模式概念与实例
2016/12/05 Javascript
前端分页功能的实现以及原理(jQuery)
2017/01/22 Javascript
js实现自定义进度条效果
2017/03/15 Javascript
bootstrap响应式表格实例详解
2017/05/15 Javascript
基于构造函数的五种继承方法小结
2017/07/27 Javascript
微信小程序倒计时功能实现代码
2017/11/09 Javascript
vue+webpack实现异步加载三种用法示例详解
2018/04/24 Javascript
node前端模板引擎Jade之标签的基本写法
2018/05/11 Javascript
vue中v-for通过动态绑定class实现触发效果
2018/12/06 Javascript
全面了解JavaScript的作用域链
2019/04/03 Javascript
js实现时分秒倒计时
2019/12/03 Javascript
[01:00]一分钟回顾2018DOTA2亚洲邀请赛现场活动
2018/04/07 DOTA
Python 使用requests模块发送GET和POST请求的实现代码
2016/09/21 Python
python实现FTP服务器服务的方法
2017/04/11 Python
Python3 循环语句(for、while、break、range等)
2017/11/20 Python
Python简单实现网页内容抓取功能示例
2018/06/07 Python
如何利用pygame实现简单的五子棋游戏
2019/12/29 Python
Python qrcode 生成一个二维码的实例详解
2020/02/12 Python
Python3 mmap内存映射文件示例解析
2020/03/23 Python
关于Kotlin中SAM转换的那些事
2020/09/15 Python
英国领先的葡萄酒专家:Majestic Wine
2017/05/30 全球购物
秘书行业自我鉴定范文
2013/12/30 职场文书
会计的岗位职责
2014/03/15 职场文书
学生打架检讨书
2014/10/20 职场文书
SpringBoot 拦截器妙用你真的了解吗
2021/07/01 Java/Android