1. 程式人生 > >python-29 python解壓壓縮包的幾種方法

python-29 python解壓壓縮包的幾種方法

這裡討論使用Python解壓例如以下五種壓縮檔案:

.gz .tar  .tgz .zip .rar

簡單介紹

gz: 即gzip。通常僅僅能壓縮一個檔案。與tar結合起來就能夠實現先打包,再壓縮。

tar: linux系統下的打包工具。僅僅打包。不壓縮

tgz:即tar.gz。先用tar打包,然後再用gz壓縮得到的檔案

zip: 不同於gzip。儘管使用相似的演算法,能夠打包壓縮多個檔案。只是分別壓縮檔案。壓縮率低於tar。

rar:打包壓縮檔案。最初用於DOS,基於window作業系統。

壓縮率比zip高,但速度慢。隨機訪問的速度也慢。

 

gz

 因為gz一般僅僅壓縮一個檔案,全部常與其它打包工具一起工作。比方能夠先用tar打包為XXX.tar,然後在壓縮為XXX.tar.gz

解壓gz,事實上就是讀出當中的單一檔案,Python方法例如以下:

import gzip
import os
def un_gz(file_name):
    """ungz zip file"""
    f_name = file_name.replace(".gz", "")
    #獲取檔案的名稱,去掉
    g_file = gzip.GzipFile(file_name)
    #建立gzip物件
    open(f_name, "w+").write(g_file.read())
    #gzip物件用read()開啟後,寫入open()建立的檔案裡。
    g_file.close()
    #關閉gzip物件

tar

XXX.tar.gz解壓後得到XXX.tar,還要進一步解壓出來。

*注:tgz與tar.gz是同樣的格式,老版本號DOS副檔名最多三個字元,故用tgz表示。

因為這裡有多個檔案,我們先讀取全部檔名稱。然後解壓。例如以下:

import tarfile
def un_tar(file_name):
       untar zip file"""
    tar = tarfile.open(file_name)
    names = tar.getnames()
    if os.path.isdir(file_name + "_files"):
        pass
    else:
        os.mkdir(file_name + "_files")
    #因為解壓後是很多檔案,預先建立同名目錄
    for name in names:
        tar.extract(name, file_name + "_files/")
    tar.close()


*注:tgz檔案與tar檔案同樣的解壓方法。

 

zip

與tar類似,先讀取多個檔名稱,然後解壓。例如以下:

import zipfile
def un_zip(file_name):
    """unzip zip file"""
    zip_file = zipfile.ZipFile(file_name)
    if os.path.isdir(file_name + "_files"):
        pass
    else:
        os.mkdir(file_name + "_files")
    for names in zip_file.namelist():
        zip_file.extract(names,file_name + "_files/")
    zip_file.close()

rar

由於rar通常為window下使用,須要額外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解壓到Python安裝資料夾的/Scripts/資料夾下,在當前窗體開啟命令列,

輸入Python setup.py install

安裝完畢。

import rarfile
import os
def un_rar(file_name):
    """unrar zip file"""
    rar = rarfile.RarFile(file_name)
    if os.path.isdir(file_name + "_files"):
        pass
    else:
        os.mkdir(file_name + "_files")
    os.chdir(file_name + "_files"):
    rar.extractall()
    rar.close()

tar打包 在寫打包程式碼的過程中,使用tar.add()新增檔案時,會把檔案本身的路徑也加進去,加上arcname就能依據自己的命名規則將檔案新增tar包 打包程式碼:
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import os  
  5.  import time  
  6.   
  7.  start = time.time()  
  8.  tar=tarfile.open('/path/to/your.tar,'w')  
  9.  for root,dir,files in os.walk('/path/to/dir/'):  
  10.          for file in files:  
  11.                  fullpath=os.path.join(root,file)  
  12.                  tar.add(fullpath,arcname=file)  
  13.  tar.close()  
  14.  print time.time()-start  
  tar解包 tar解包也能夠依據不同壓縮格式來解壓。
  1. #!/usr/bin/env /usr/local/bin/python  
  2.  # encoding: utf-8  
  3.  import tarfile  
  4.  import time  
  5.   
  6.  start = time.time()  
  7.  t = tarfile.open("/path/to/your.tar", "r:")  
  8.  t.extractall(path = '/path/to/extractdir/')  
  9.  t.close()  
  10.  print time.time()-start  
  上面的程式碼是解壓全部的,也能夠挨個起做不同的處理,但要假設tar包內檔案過多,小心記憶體哦~
  1. tar = tarfile.open(filename, 'r:gz')  
  2. for tar_info in tar:  
  3.     file = tar.extractfile(tar_info)  
  4.     do_something_with(file)