设为首页 收藏本站
查看: 1198|回复: 0

[经验分享] python 解压 压缩包

[复制链接]
累计签到:19 天
连续签到:1 天
发表于 2015-12-1 15:17:48 | 显示全部楼层 |阅读模式
  转 http://m.blog.csdn.net/blog/wice110956/26597179#
  这里讨论使用Python解压如下五种压缩文件:
  .gz .tar  .tgz .zip .rar

简介
  gz: 即gzip,通常只能压缩一个文件。与tar结合起来就可以实现先打包,再压缩。
  tar: linux系统下的打包工具,只打包,不压缩
  tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件
  zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,压缩率低于tar。
  rar:打包压缩文件,最初用于DOS,基于window操作系统。压缩率比zip高,但速度慢,随机访问的速度也慢。
  关于zip于rar之间的各种比较,可见:
  http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz
  由于gz一般只压缩一个文件,所有常与其他打包工具一起工作。比如可以先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz
  解压gz,其实就是读出其中的单一文件,Python方法如下:
  

import gzip
import os
def un_gz(file_name):
"""ungz zip file"""
f_name = file_name.replace(".gz", "")
#获取文件的名称,去掉
g_file = gzip.GzipFile(file_name)
#创建gzip对象
open(f_name, "w+").write(g_file.read())
#gzip对象用read()打开后,写入open()建立的文件中。
g_file.close()
#关闭gzip对象<span> </span>
  

tar
  XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。
  *注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。
  由于这里有多个文件,我们先读取所有文件名,然后解压,如下:
  

import tarfile
def un_tar(file_name):
untar zip file"""
tar = tarfile.open(file_name)
names = tar.getnames()
if os.path.isdir(file_name + "_files"):
pass
else:
os.mkdir(file_name + "_files")
#由于解压后是许多文件,预先建立同名文件夹
for name in names:
tar.extract(name, file_name + "_files/")
tar.close()
  
  *注:tgz文件与tar文件相同的解压方法。

zip
  与tar类似,先读取多个文件名,然后解压,如下:
  

import zipfile
def un_zip(file_name):
"""unzip zip file"""
zip_file = zipfile.ZipFile(file_name)
if os.path.isdir(file_name + "_files"):
pass
else:
os.mkdir(file_name + "_files")
for names in zip_file.namelist():
zip_file.extract(names,file_name + "_files/")
zip_file.close()
  

rar
  因为rar通常为window下使用,需要额外的Python包rarfile。
  可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download
  解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,
  输入Python setup.py install
  安装完成。
  

import rarfile
import os
def un_rar(file_name):
"""unrar zip file"""
rar = rarfile.RarFile(file_name)
if os.path.isdir(file_name + "_files"):
pass
else:
os.mkdir(file_name + "_files")
os.chdir(file_name + "_files"):
rar.extractall()
rar.close()




tar打包

在写打包代码的过程中,使用tar.add()增加文件时,会把文件本身的路径也加进去,加上arcname就能根据自己的命名规则将文件加入tar包

打包代码:







Python代码   DSC0000.png

  • #!/usr/bin/env /usr/local/bin/python  
  • # encoding: utf-8  
  • import tarfile  
  • import os  
  • import time  

  • start = time.time()
  • tar=tarfile.open('/path/to/your.tar,'w')  
  • for root,dir,files in os.walk('/path/to/dir/'):  
  •          for file in files:  
  •                  fullpath=os.path.join(root,file)
  •                  tar.add(fullpath,arcname=file)
  • tar.close()
  • print time.time()-start  




在打包的过程中可以设置压缩规则,如想要以gz压缩的格式打包

tar=tarfile.open('/path/to/your.tar.gz','w:gz')

其他格式如下表:

tarfile.open的mode有很多种:

mode action
'r' or 'r:*'Open for reading with transparent compression (recommended).
'r:'Open for reading exclusively without compression.
'r:gz'Open for reading with gzip compression.
'r:bz2'Open for reading with bzip2 compression.
'a' or 'a:'Open for appending with no compression. The file is created if it does not exist.
'w' or 'w:'Open for uncompressed writing.
'w:gz'Open for gzip compressed writing.
'w:bz2'Open for bzip2 compressed writing.




tar解包

tar解包也可以根据不同压缩格式来解压。







Python代码  

  • #!/usr/bin/env /usr/local/bin/python  
  • # encoding: utf-8  
  • import tarfile  
  • import time  

  • start = time.time()
  • t = tarfile.open("/path/to/your.tar", "r:")  
  • t.extractall(path = '/path/to/extractdir/')  
  • t.close()
  • print time.time()-start  




上面的代码是解压所有的,也可以挨个起做不同的处理,但要如果tar包内文件过多,小心内存哦~







Python代码  

  • tar = tarfile.open(filename, 'r:gz')  
  • for tar_info in tar:  
  •     file = tar.extractfile(tar_info)
  •     do_something_with(file)

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-145990-1-1.html 上篇帖子: python网络编程应用(一) 下篇帖子: [python学习]结合开源库学习python
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表