python解壓壓縮包的幾種方式

這裏討論使用Python解壓以下五種壓縮文件:python

.gz .tar  .tgz .zip .rarlinux

簡介

gz: 即gzip,一般只能壓縮一個文件。與tar結合起來就能夠實現先打包,再壓縮。ios

tar: linux系統下的打包工具,只打包,不壓縮算法

tgz:即tar.gz。先用tar打包,而後再用gz壓縮獲得的文件app

zip: 不一樣於gzip,雖然使用類似的算法,能夠打包壓縮多個文件,不過度別壓縮文件,壓縮率低於tar。工具

rar:打包壓縮文件,最初用於DOS,基於window操做系統。壓縮率比zip高,但速度慢,隨機訪問的速度也慢。spa

關於zip於rar之間的各類比較,可見: 操作系統

http://www.comicer.com/stronghorse/water/software/ziprar.htm.net

gz

因爲gz通常只壓縮一個文件,全部常與其餘打包工具一塊兒工做。好比能夠先用tar打包爲XXX.tar,而後在壓縮爲XXX.tar.gz命令行

解壓gz,其實就是讀出其中的單一文件,Python方法以下:

[python]  view plain  copy
 
  1. import gzip  
  2. import os  
  3. def un_gz(file_name):  
  4.     """ungz zip file"""  
  5.     f_name = file_name.replace(".gz", "")  
  6.     #獲取文件的名稱,去掉  
  7.     g_file = gzip.GzipFile(file_name)  
  8.     #建立gzip對象  
  9.     open(f_name, "w+").write(g_file.read())  
  10.     #gzip對象用read()打開後,寫入open()創建的文件中。  
  11.     g_file.close()  
  12.     #關閉gzip對象  

 

tar

XXX.tar.gz解壓後獲得XXX.tar,還要進一步解壓出來。

*注:tgz與tar.gz是相同的格式,老版本DOS擴展名最多三個字符,故用tgz表示。

因爲這裏有多個文件,咱們先讀取全部文件名,而後解壓,以下:

[python]  view plain  copy
 
  1. import tarfile  
  2. def un_tar(file_name):  
  3.        untar zip file"""  
  4.     tar = tarfile.open(file_name)  
  5.     names = tar.getnames()  
  6.     if os.path.isdir(file_name + "_files"):  
  7.         pass  
  8.     else:  
  9.         os.mkdir(file_name + "_files")  
  10.     #因爲解壓後是許多文件,預先創建同名文件夾  
  11.     for name in names:  
  12.         tar.extract(name, file_name + "_files/")  
  13.     tar.close()  


*注:tgz文件與tar文件相同的解壓方法。

 

 

zip

與tar相似,先讀取多個文件名,而後解壓,以下:

[python]  view plain  copy
 
  1. import zipfile  
  2. def un_zip(file_name):  
  3.     """unzip zip file"""  
  4.     zip_file = zipfile.ZipFile(file_name)  
  5.     if os.path.isdir(file_name + "_files"):  
  6.         pass  
  7.     else:  
  8.         os.mkdir(file_name + "_files")  
  9.     for names in zip_file.namelist():  
  10.         zip_file.extract(names,file_name + "_files/")  
  11.     zip_file.close()  

 

 

rar

由於rar一般爲window下使用,須要額外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解壓到Python安裝目錄的/Scripts/目錄下,在當前窗口打開命令行,

輸入Python setup.py install

安裝完成。

[python]  view plain  copy
 
  1. import rarfile  
  2. import os  
  3. def un_rar(file_name):  
  4.     """unrar zip file"""  
  5.     rar = rarfile.RarFile(file_name)  
  6.     if os.path.isdir(file_name + "_files"):  
  7.         pass  
  8.     else:  
  9.         os.mkdir(file_name + "_files")  
  10.     os.chdir(file_name + "_files"):  
  11.     rar.extractall()  
  12.     rar.close()  



 

tar打包
在寫打包代碼的過程當中,使用tar.add()增長文件時,會把文件自己的路徑也加進去,加上arcname就能根據本身的命名規則將文件加入tar包
打包代碼:
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import os  
  5.  import time  
  6.   
  7.  start = time.time()  
  8.  tar=tarfile.open('/path/to/your.tar,'w')  
  9.  for root,dir,files in os.walk('/path/to/dir/'):  
  10.          for file in files:  
  11.                  fullpath=os.path.join(root,file)  
  12.                  tar.add(fullpath,arcname=file)  
  13.  tar.close()  
  14.  print time.time()-start  

 

 

在打包的過程當中能夠設置壓縮規則,如想要以gz壓縮的格式打包
tar=tarfile.open('/path/to/your.tar.gz','w:gz')
其餘格式以下表:
tarfile.open的mode有不少種:
mode action
'r' or 'r:*' Open for reading with transparent compression (recommended).
'r:' Open for reading exclusively without compression.
'r:gz' Open for reading with gzip compression.
'r:bz2' Open for reading with bzip2 compression.
'a' or 'a:' Open for appending with no compression. The file is created if it does not exist.
'w' or 'w:' Open for uncompressed writing.
'w:gz' Open for gzip compressed writing.
'w:bz2' Open for bzip2 compressed writing.
 
tar解包
tar解包也能夠根據不一樣壓縮格式來解壓。
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import time  
  5.   
  6.  start = time.time()  
  7.  t = tarfile.open("/path/to/your.tar", "r:")  
  8.  t.extractall(path = '/path/to/extractdir/')  
  9.  t.close()  
  10.  print time.time()-start  
 
 
上面的代碼是解壓全部的,也能夠挨個起作不一樣的處理,但要若是tar包內文件過多,當心內存哦~

 

  1. tar = tarfile.open(filename, 'r:gz')  
  2. for tar_info in tar:  
  3.     file = tar.extractfile(tar_info)  
  4.     do_something_with(file)  

這裏討論使用Python解壓以下五種壓縮文件:

.gz .tar  .tgz .zip .rar

簡介

gz: 即gzip,一般只能壓縮一個文件。與tar結合起來就能夠實現先打包,再壓縮。

tar: linux系統下的打包工具,只打包,不壓縮

tgz:即tar.gz。先用tar打包,而後再用gz壓縮獲得的文件

zip: 不一樣於gzip,雖然使用類似的算法,能夠打包壓縮多個文件,不過度別壓縮文件,壓縮率低於tar。

rar:打包壓縮文件,最初用於DOS,基於window操做系統。壓縮率比zip高,但速度慢,隨機訪問的速度也慢。

關於zip於rar之間的各類比較,可見: 

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

因爲gz通常只壓縮一個文件,全部常與其餘打包工具一塊兒工做。好比能夠先用tar打包爲XXX.tar,而後在壓縮爲XXX.tar.gz

解壓gz,其實就是讀出其中的單一文件,Python方法以下:

[python]  view plain  copy
 
  1. import gzip  
  2. import os  
  3. def un_gz(file_name):  
  4.     """ungz zip file"""  
  5.     f_name = file_name.replace(".gz", "")  
  6.     #獲取文件的名稱,去掉  
  7.     g_file = gzip.GzipFile(file_name)  
  8.     #建立gzip對象  
  9.     open(f_name, "w+").write(g_file.read())  
  10.     #gzip對象用read()打開後,寫入open()創建的文件中。  
  11.     g_file.close()  
  12.     #關閉gzip對象  

 

tar

XXX.tar.gz解壓後獲得XXX.tar,還要進一步解壓出來。

*注:tgz與tar.gz是相同的格式,老版本DOS擴展名最多三個字符,故用tgz表示。

因爲這裏有多個文件,咱們先讀取全部文件名,而後解壓,以下:

[python]  view plain  copy
 
  1. import tarfile  
  2. def un_tar(file_name):  
  3.        untar zip file"""  
  4.     tar = tarfile.open(file_name)  
  5.     names = tar.getnames()  
  6.     if os.path.isdir(file_name + "_files"):  
  7.         pass  
  8.     else:  
  9.         os.mkdir(file_name + "_files")  
  10.     #因爲解壓後是許多文件,預先創建同名文件夾  
  11.     for name in names:  
  12.         tar.extract(name, file_name + "_files/")  
  13.     tar.close()  


*注:tgz文件與tar文件相同的解壓方法。

 

 

zip

與tar相似,先讀取多個文件名,而後解壓,以下:

[python]  view plain  copy
 
  1. import zipfile  
  2. def un_zip(file_name):  
  3.     """unzip zip file"""  
  4.     zip_file = zipfile.ZipFile(file_name)  
  5.     if os.path.isdir(file_name + "_files"):  
  6.         pass  
  7.     else:  
  8.         os.mkdir(file_name + "_files")  
  9.     for names in zip_file.namelist():  
  10.         zip_file.extract(names,file_name + "_files/")  
  11.     zip_file.close()  

 

 

rar

由於rar一般爲window下使用,須要額外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解壓到Python安裝目錄的/Scripts/目錄下,在當前窗口打開命令行,

輸入Python setup.py install

安裝完成。

[python]  view plain  copy
 
  1. import rarfile  
  2. import os  
  3. def un_rar(file_name):  
  4.     """unrar zip file"""  
  5.     rar = rarfile.RarFile(file_name)  
  6.     if os.path.isdir(file_name + "_files"):  
  7.         pass  
  8.     else:  
  9.         os.mkdir(file_name + "_files")  
  10.     os.chdir(file_name + "_files"):  
  11.     rar.extractall()  
  12.     rar.close()  



 

tar打包
在寫打包代碼的過程當中,使用tar.add()增長文件時,會把文件自己的路徑也加進去,加上arcname就能根據本身的命名規則將文件加入tar包
打包代碼:
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import os  
  5.  import time  
  6.   
  7.  start = time.time()  
  8.  tar=tarfile.open('/path/to/your.tar,'w')  
  9.  for root,dir,files in os.walk('/path/to/dir/'):  
  10.          for file in files:  
  11.                  fullpath=os.path.join(root,file)  
  12.                  tar.add(fullpath,arcname=file)  
  13.  tar.close()  
  14.  print time.time()-start  

 

 

在打包的過程當中能夠設置壓縮規則,如想要以gz壓縮的格式打包
tar=tarfile.open('/path/to/your.tar.gz','w:gz')
其餘格式以下表:
tarfile.open的mode有不少種:
mode action
'r' or 'r:*' Open for reading with transparent compression (recommended).
'r:' Open for reading exclusively without compression.
'r:gz' Open for reading with gzip compression.
'r:bz2' Open for reading with bzip2 compression.
'a' or 'a:' Open for appending with no compression. The file is created if it does not exist.
'w' or 'w:' Open for uncompressed writing.
'w:gz' Open for gzip compressed writing.
'w:bz2' Open for bzip2 compressed writing.
 
tar解包
tar解包也能夠根據不一樣壓縮格式來解壓。
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import time  
  5.   
  6.  start = time.time()  
  7.  t = tarfile.open("/path/to/your.tar", "r:")  
  8.  t.extractall(path = '/path/to/extractdir/')  
  9.  t.close()  
  10.  print time.time()-start  
 
 
上面的代碼是解壓全部的,也能夠挨個起作不一樣的處理,但要若是tar包內文件過多,當心內存哦~

  1. tar = tarfile.open(filename, 'r:gz')  
  2. for tar_info in tar:  
  3.     file = tar.extractfile(tar_info)  
  4.     do_something_with(file)  
相關文章
相關標籤/搜索