這裏討論使用Python解壓例如如下五種壓縮文件:python
.gz .tar .tgz .zip .rarlinux
gz: 即gzip。一般僅僅能壓縮一個文件。與tar結合起來就可以實現先打包,再壓縮。ios
tar: linux系統下的打包工具。僅僅打包。不壓縮算法
tgz:即tar.gz。先用tar打包,而後再用gz壓縮獲得的文件工具
zip: 不一樣於gzip。儘管使用類似的算法,可以打包壓縮多個文件。只是分別壓縮文件。壓縮率低於tar。spa
rar:打包壓縮文件。最初用於DOS,基於window操做系統。操作系統
壓縮率比zip高,但速度慢。隨機訪問的速度也慢。.net
由於gz通常僅僅壓縮一個文件,所有常與其它打包工具一塊兒工做。比方可以先用tar打包爲XXX.tar,而後在壓縮爲XXX.tar.gz命令行
解壓gz,事實上就是讀出當中的單一文件,Python方法例如如下:code
import gzip import os def un_gz(file_name): """ungz zip file""" f_name = file_name.replace(".gz", "") #獲取文件的名稱,去掉 g_file = gzip.GzipFile(file_name) #建立gzip對象 open(f_name, "w+").write(g_file.read()) #gzip對象用read()打開後,寫入open()創建的文件裏。 g_file.close() #關閉gzip對象
XXX.tar.gz解壓後獲得XXX.tar,還要進一步解壓出來。
*注:tgz與tar.gz是一樣的格式,老版本號DOS擴展名最多三個字符,故用tgz表示。
由於這裏有多個文件,咱們先讀取所有文件名稱。而後解壓。例如如下:
import tarfile def un_tar(file_name): untar zip file""" tar = tarfile.open(file_name) names = tar.getnames() if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") #由於解壓後是不少文件,預先創建同名目錄 for name in names: tar.extract(name, file_name + "_files/") tar.close()
*注:tgz文件與tar文件一樣的解壓方法。
與tar相似,先讀取多個文件名稱,而後解壓。例如如下:
import zipfile def un_zip(file_name): """unzip zip file""" zip_file = zipfile.ZipFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") for names in zip_file.namelist(): zip_file.extract(names,file_name + "_files/") zip_file.close()
因爲rar一般爲window下使用,需要額外的Python包rarfile。
可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download
解壓到Python安裝文件夾的/Scripts/文件夾下,在當前窗體打開命令行,
輸入Python setup.py install
安裝完畢。
import rarfile import os def un_rar(file_name): """unrar zip file""" rar = rarfile.RarFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") os.chdir(file_name + "_files"): rar.extractall() rar.close()