转 http://m.blog.csdn.net/blog/wice110956/26597179#python
这里讨论使用Python解压以下五种压缩文件:linux
.gz .tar .tgz .zip .rarios
gz: 即gzip,一般只能压缩一个文件。与tar结合起来就能够实现先打包,再压缩。算法
tar: linux系统下的打包工具,只打包,不压缩app
tgz:即tar.gz。先用tar打包,而后再用gz压缩获得的文件工具
zip: 不一样于gzip,虽然使用类似的算法,能够打包压缩多个文件,不过度别压缩文件,压缩率低于tar。spa
rar:打包压缩文件,最初用于DOS,基于window操做系统。压缩率比zip高,但速度慢,随机访问的速度也慢。操作系统
关于zip于rar之间的各类比较,可见: .net
http://www.comicer.com/stronghorse/water/software/ziprar.htm命令行
因为gz通常只压缩一个文件,全部常与其余打包工具一块儿工做。好比能够先用tar打包为XXX.tar,而后在压缩为XXX.tar.gz
解压gz,其实就是读出其中的单一文件,Python方法以下:
import gzip import os def un_gz(file_name): """ungz zip file""" f_name = file_name.replace(".gz", "") #获取文件的名称,去掉 g_file = gzip.GzipFile(file_name) #建立gzip对象 open(f_name, "w+").write(g_file.read()) #gzip对象用read()打开后,写入open()创建的文件中。 g_file.close() #关闭gzip对象<span style="font-family: Arial, Helvetica, sans-serif; "> </span>
XXX.tar.gz解压后获得XXX.tar,还要进一步解压出来。
*注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。
因为这里有多个文件,咱们先读取全部文件名,而后解压,以下:
import tarfile def un_tar(file_name): untar zip file""" tar = tarfile.open(file_name) names = tar.getnames() if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") #因为解压后是许多文件,预先创建同名文件夹 for name in names: tar.extract(name, file_name + "_files/") tar.close()
*注:tgz文件与tar文件相同的解压方法。
与tar相似,先读取多个文件名,而后解压,以下:
import zipfile def un_zip(file_name): """unzip zip file""" zip_file = zipfile.ZipFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") for names in zip_file.namelist(): zip_file.extract(names,file_name + "_files/") zip_file.close()
由于rar一般为window下使用,须要额外的Python包rarfile。
可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download
解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,
输入Python setup.py install
安装完成。
import rarfile import os def un_rar(file_name): """unrar zip file""" rar = rarfile.RarFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") os.chdir(file_name + "_files"): rar.extractall() rar.close()
'r' or 'r:*' | Open for reading with transparent compression (recommended). |
'r:' | Open for reading exclusively without compression. |
'r:gz' | Open for reading with gzip compression. |
'r:bz2' | Open for reading with bzip2 compression. |
'a' or 'a:' | Open for appending with no compression. The file is created if it does not exist. |
'w' or 'w:' | Open for uncompressed writing. |
'w:gz' | Open for gzip compressed writing. |
'w:bz2' | Open for bzip2 compressed writing. |